核心用法
Exa Full 是一套企业级 AI 搜索与研究工具集,封装了 Exa AI 的核心能力:
1. 通用搜索 (`search.sh`):支持神经/快速/深度三种搜索模式,可按类别(新闻、公司、人物、论文、GitHub、推文、PDF、财报)精准检索,支持域名白名单/黑名单、时间范围、地理位置过滤。
2. 代码上下文搜索 (`code.sh`):专为代码理解设计的语义检索。
3. 内容提取 (`content.sh`):从 URL 提取完整文本,支持子页面爬取(SUBPAGES)、实时抓取(LIVECRAWL)及智能高亮摘要。
4. 异步研究 (`research.sh`):多步骤深度研究任务,可选 exa-research 或 exa-research-pro 模型,支持自定义 JSON Schema 输出,自动轮询直至完成。
显著优点
- 搜索精度高:神经搜索理解语义意图,超越关键词匹配
- 结构化输出:Research API 支持
outputSchema,便于 Agent 集成 - 企业数据覆盖:内置公司、财报、学术论文等专业类别
- 灵活的内容获取:实时抓取 + 子页面深度爬取,解决动态内容问题
- Agent 友好:清晰的「搜索→提取→研究」三段式工作流
潜在缺点与局限性
- 成本较高:深度搜索(
TYPE=deep)和 Pro 研究模型消耗更多 token - 异步任务延迟:Research API 需轮询等待,非即时响应
- 依赖外部 API:需稳定网络与有效 API Key,存在服务商可用性风险
- 爬取限制:子页面爬取有数量上限,复杂站点可能不完整
- 语言支持:对非英文内容的检索质量可能下降
适合人群
- AI Agent / 自动化工作流开发者
- 投资研究员、竞品分析师、学术研究者
- 需要大规模网络数据挖掘的企业数据团队
- 构建知识库 RAG 系统的工程师
常规风险
- API 密钥泄露:
EXA_API_KEY需妥善保管,避免硬编码 - 数据合规:抓取网页内容需遵守 robots.txt 及版权法规
- 成本控制:异步研究任务可能产生意外高额费用,建议设置
MAX_WAIT_SECONDS - 结果偏差:AI 搜索可能存在幻觉,关键决策需人工核实来源