核心用法
search 技能是 Tavily Search API 的轻量级封装,专为 LLM 消费场景优化。用户通过 --json 参数传入原始 API 请求体,支持完整的 Tavily 搜索能力:基础/高级搜索深度、时间范围过滤(day/week/month/year)、域名白名单/黑名单、以及是否包含原始页面内容、图片、图标等元数据。
典型调用模式:
- 快速事实核查:
{"query": "事件 X 最新进展", "time_range": "week"} - 深度研究:
{"query": "技术 Y 原理", "search_depth": "advanced", "max_results": 15} - 信源限定:
{"query": "财报分析", "include_domains": ["sec.gov", "reuters.com"]}
关键参数建议:
- 查询长度控制在 400 字符内,采用搜索引擎关键词而非自然语言长提示
- 复杂主题拆分为多个子查询,优于单一冗长查询
- 默认推荐
advanced深度以获取更高精度结果
显著优点
1. LLM 原生优化:返回结构化的 JSON 结果,含相关性评分(score)、内容摘要、元数据,无需额外解析 HTML
2. 实时信息获取:弥补 LLM 训练数据截止时间的局限,支持检索当日/本周新闻
3. 细粒度控制:20 余项参数支持从泛化搜索到精准信源定位的全谱系需求
4. 低集成成本:单脚本封装,环境变量配置 API Key 后即可使用,无复杂依赖
潜在局限
- 商业依赖:依赖 Tavily 第三方服务,存在 API 可用性与定价策略变更风险
- 结果黑箱:搜索算法的相关性评分机制不透明,无法自定义排序逻辑
- 内容完整性:
include_raw_content为可选功能,可能受目标网站反爬策略影响 - 速率限制:未披露具体配额,高并发场景需自行管理请求频率
适合人群
- 需要为 AI Agent 集成实时搜索能力的开发者
- 进行事实核查、来源验证的研究人员与内容创作者
- 构建 RAG 系统、需动态检索外部知识库的工程师
常规风险
| 风险类别 | 说明 | 缓解建议 |
|---------|------|---------|
| API 密钥泄露 | `TAVILY_API_KEY` 以明文环境变量存储 | 使用密钥管理服务,避免提交至版本控制 |
| 搜索结果偏见 | Tavily 算法可能强化主流信源,边缘观点覆盖不足 | 显式配置 `include_domains` 引入多元来源 |
| 信息时效误判 | `time_range` 依赖网页标注时间,可能存在滞后 | 交叉验证关键信息的原始发布时间 |
| 合规边界 | 抓取某些域名可能违反 robots.txt 或服务条款 | 遵守目标网站的爬虫政策,敏感领域启用 `exclude_domains` |