aminer-data-search

📚 全球学术数据一站式智能检索

AMiner官方学术数据平台技能,覆盖学者、论文、机构、期刊、专利等6大工作流与28个API,支持智能检索与深度分析。

收藏
6.5k
安装
2.4k
版本
1.0.7
CLS 安全性认证2026-08-10
点击查看完整报告 >

使用说明

核心用法

AMiner Data Search 是面向科研场景的专业学术数据查询技能,基于AMiner开放平台API构建。用户可通过自然语言或结构化参数,快速获取学者画像、论文详情、机构分析、期刊追踪、专利检索等全维度学术情报。

六种核心工作流:

  • Scholar Profile(学者画像):输入学者姓名,并行获取个人简介、研究方向、教育经历、论文列表、专利及科研项目
  • Paper Deep Dive(论文深度分析):通过标题或关键词定位论文,获取摘要、作者、引用关系等完整信息
  • Org Analysis(机构分析):解析机构名称歧义,输出学者规模、论文产出、专利布局等竞争情报
  • Venue Papers(期刊/会议追踪):按年份检索特定期刊的发表论文,支持投稿趋势分析
  • Paper QA Search(学术问答检索):自然语言语义搜索,支持SCI过滤、引用排序、作者/机构约束
  • Patent Analysis(专利分析):技术领域专利检索,或关联学者/机构的专利组合

直接API调用:支持28个独立API的raw模式调用,满足定制化查询需求。

显著优点

1. 数据覆盖全面:AMiner是全球领先的学术数据平台,收录亿级论文、千万级学者、百万级机构数据
2. 智能工作流封装:6大组合工作流自动编排最优API调用链,降低用户使用门槛

3. 成本分层设计:免费API优先策略(paper_search、paper_info等),付费API按需升级

4. 语义搜索能力:Paper QA Search支持自然语言理解,自动拆解查询意图

5. 结果可追溯:组合查询输出标注source_api_chain,明确数据来源路径

6. 安全机制完善:内置Token安全校验、指数退避重试、失败自动降级策略

潜在局限

1. 付费API成本敏感:学者详情(¥1.00/次)、科研项目(¥3.00/次)等高价值接口单次成本较高,大规模批量查询需谨慎
2. 中文数据覆盖有限:核心优势在英文计算机、AI领域,人文社科及部分中文期刊覆盖较弱

3. 实时性延迟:数据更新非实时,最新发表论文可能存在数周滞后

4. 机构消歧依赖Pro版:免费org_search可能返回多个候选,精准匹配需付费org_disambiguation_pro(¥0.05/次)

5. 自然语言理解边界:复杂查询意图拆解可能偏离用户预期,需人工校验

适合人群

  • 科研人员:快速调研领域学者、追踪论文引用、分析研究机构实力
  • 学生群体:导师背景调查、论文写作参考文献检索、学术趋势把握
  • 科研管理者:机构学术产出评估、人才引进背景核查、竞争对标分析
  • 技术情报分析师:专利布局研究、技术路线图绘制、产学研合作挖掘
  • 学术编辑/出版从业者:期刊投稿分析、审稿人推荐、学术影响力评估

常规风险

1. Token泄露风险:API Key需妥善保管,技能已强制禁止明文输出,但用户环境变量配置不当仍可能导致泄露
2. 计费失控风险:批量查询默认仅返回TOP 10详情,但raw模式或无约束调用可能产生意外费用

3. 数据准确性风险:学者机构归属、论文作者消歧存在算法误差,关键决策建议人工复核

4. 服务可用性风险:依赖AMiner官方服务,存在网络波动、接口限流、服务变更等外部依赖风险

5. 合规使用边界:数据仅限研究用途,商用需遵守AMiner开放平台服务协议

安全解读

核心用法

AMiner学术数据查询Skill是面向科研场景的专业数据工具,提供6大组合工作流和28个独立API的完整覆盖。用户可通过Python客户端或原始API调用,实现学者画像分析、论文深度检索、机构竞争力评估、期刊论文追踪、学术问答搜索及专利分析等核心功能。

六大工作流快速入口

  • 学者画像 (scholar_profile):输入学者姓名,自动聚合生平、研究方向、论文列表、专利及项目信息
  • 论文深度分析 (paper_deep_dive):基于标题或关键词定位论文,获取摘要、引用链、相关论文等完整信息
  • 机构分析 (org_analysis):分析高校/研究机构的学者规模、论文产出、专利布局
  • 期刊论文 (venue_papers):按年份追踪特定期刊/会议的发表论文
  • 学术问答 (paper_qa):支持自然语言提问,智能语义检索相关论文
  • 专利分析 (patent_search):技术领域专利检索及学者/机构专利组合分析

API调用策略:工具内置智能路由,根据查询目标自动选择最优API组合,优先使用免费接口,仅在必要时升级至付费接口以控制成本。

显著优点

1. 数据权威性:直接对接AMiner全球领先学术数据库,覆盖学者、论文、机构、期刊、专利等多维数据
2. 成本优化设计:内置"免费优先"策略,智能选择paper_search等免费API完成基础查询,付费API仅用于深度字段

3. 完整工作流:6大预设工作流覆盖90%科研场景,无需用户自行编排API调用链

4. 自然语言支持paper_qa_search支持自然语言提问,降低非专业用户的使用门槛

5. 稳定性保障:内置指数退避重试机制(1s→2s→4s+抖动),自动处理网络波动和服务 transient 错误

6. 安全合规:Token仅从环境变量读取,无硬编码密钥;所有通信采用HTTPS加密

潜在缺点与局限性

1. 付费接口成本:深度功能(如学者详情¥1.00/次、学者项目¥3.00/次)对高频使用场景成本较高
2. 中文数据覆盖:作为起源于中国的平台,非中文地区部分学者的数据完整性可能弱于Web of Science等竞品

3. 实时性限制:学术数据更新存在滞后,最新发表论文可能尚未入库

4. API调用限制:未明确披露速率限制,大规模批量检索可能触发限流

5. 依赖官方服务:所有功能依赖AMiner平台可用性,单点故障风险

适合的目标群体

  • 高校科研人员:快速调研领域学者、追踪学术成果、分析合作机构
  • 研究生/博士生:文献调研、选题分析、导师背景调查、期刊投稿研究
  • 科研机构管理者:机构竞争力评估、人才引进决策、产学研合作分析
  • 科技企业研发部门:技术趋势分析、专利布局研究、学术界合作挖掘
  • 学术出版与信息服务:期刊影响力分析、选题策划、审稿人推荐

使用风险

1. 成本控制风险:未设置查询数量上限时,可能因返回大量结果而产生意外费用。Skill已内置保护机制(默认仅取Top 10详情),但用户仍需关注--size参数设置
2. Token泄露风险:虽然工具本身不从代码泄露Token,但用户可能在命令行历史、日志中意外暴露。建议始终使用环境变量方式配置

3. 数据准确性依赖:学者同名消歧、机构别名合并等依赖AMiner底层数据质量,可能存在误判

4. 网络依赖:学术查询场景常涉及境外API节点,网络延迟可能影响体验(工具已配置30s超时和3次重试)

5. 合规使用边界:获取的学术数据应遵守AMiner服务条款,禁止大规模爬取或商业转售

aminer-data-search 内容

evals文件夹
references文件夹
scripts文件夹
手动下载zip · 23.9 kB
evals.jsonapplication/json
请选择文件