aminer-data-search

🎓 全球学术数据一站式智能查询

AMiner官方学术数据查询工具,支持学者画像、论文深度挖掘、机构分析、期刊监控、智能问答及专利链分析六大工作流,覆盖28个API,数据来源权威,适合科研人员与机构调研,需注意Token安全与费用控制。

收藏
4.8k
安装
2.4k
版本
1.0.3
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

AMiner学术数据查询skill提供六大组合工作流28个独立API的直接调用能力,覆盖学术数据全场景:

| 工作流 | 核心能力 | 典型场景 |
|--------|---------|---------|
| 学者全景分析 | 学者详情+画像+论文+专利+项目 | 了解某位学者的完整学术履历 |
| 论文深度挖掘 | 搜索→详情→引用链扩展 | 追踪某篇论文的完整信息与学术影响 |
| 机构研究力分析 | 机构消歧→详情+学者+论文+专利 | 评估高校/企业的科研产出与合作价值 |
| 期刊论文监控 | 期刊搜索→年度论文追踪 | 投稿选刊、研究热点分析 |
| 学术智能问答 | 自然语言语义检索 | 用对话式提问快速定位相关论文 |
| 专利链分析 | 专利搜索→详情,或经学者/机构关联 | 技术领域专利布局分析 |

调用方式:通过scripts/aminer_client.py驱动,支持环境变量AMINER_API_KEY自动读取,或显式传--token

显著优点

1. 数据权威性:AMiner是全球领先的学术数据平台,数据覆盖学者、论文、机构、期刊、专利全维度,来源可信(T1级)
2. 工作流智能化:6大预设工作流已优化API组合顺序,自动处理并行调用、降级策略(如paper_search无结果自动降级到paper_search_pro)

3. 成本控制机制:内置"免费优先"策略,未明确要求深度字段时优先使用免费接口;结果量大时默认仅查询前10条详情

4. 安全合规性:强制Token安全检查,严禁泄露明文;所有实体返回时强制附加可访问URL

5. 稳定性保障:内置指数退避重试(3次)、超时控制(30s)、可追踪调用链(source_api_chain

潜在缺点与局限性

1. Token依赖门槛:必须先获取AMiner开放平台Token,无Token时完全无法使用
2. 费用分层复杂:28个API价格从免费到¥3.00不等,用户需理解paper_info(免费)vs paper_detail(¥0.01)等细微差别,否则易产生意外费用

3. 参数约束严格paper_detail只能用paper_idpaper_info必须用ids,raw模式调用前必须核对函数签名,易因参数混淆导致失败

4. 中文场景优化:AMiner虽支持中文,但部分字段(如学者简介、期刊元数据)的英文覆盖度优于中文

5. 实时性限制:学术数据更新存在滞后,最新发表论文可能暂未收录

适合人群

  • 科研人员:快速调研合作学者、追踪领域论文、分析引用关系
  • 研究生/博士生:选刊投稿分析、文献综述批量获取
  • 科研机构管理者:评估本机构或竞品机构的科研产出与影响力
  • 企业战略/专利部门:技术趋势监控、专利布局分析、潜在合作学者挖掘
  • 学术出版从业者:期刊影响力追踪、热点选题发现

常规风险

| 风险类型 | 具体说明 | 缓解措施 |
|---------|---------|---------|
| Token泄露风险 | 明文Token一旦被记录将暴露账户 | 强制环境变量读取,禁止任何输出/日志记录Token |
| 费用失控风险 | 无差别全量拉取(如对1000条结果全部调detail)导致高额费用 | 强制默认前10条限制;优先低成本接口筛选 |
| 数据误用风险 | 学者同名消歧错误、机构别名匹配偏差 | 使用`organization/na/pro`消歧;结合ID精确过滤 |
| API变更风险 | 28个API参数或路径可能迭代 | 以`references/api-catalog.md`为最终准则 |
| 网络超时风险 | 学术数据量大,偶发服务不稳定 | 内置3次指数退避重试,失败时返回结构化错误 |

> 使用建议:生产环境务必配置AMINER_API_KEY环境变量,避免命令行暴露Token;复杂查询前先小额测试验证API组合与费用预期。

aminer-data-search 内容

evals文件夹
references文件夹
scripts文件夹
手动下载zip · 24.0 kB
evals.jsonapplication/json
请选择文件