Tavily Search

🔍 为 AI 而生的实时搜索利器

Tavily 搜索 API 封装技能,为 LLM 提供结构化网页搜索结果,支持深度检索、时间过滤与域名限定,适合实时信息查询与来源验证

收藏
3.7k
安装
1.3k
版本
4.1.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

search 技能是 Tavily Search API 的轻量级封装,专为 LLM 消费场景优化。用户通过 --json 参数传入原始 API 请求体,支持完整的 Tavily 搜索能力:基础/高级搜索深度、时间范围过滤(day/week/month/year)、域名白名单/黑名单、以及是否包含原始页面内容、图片、图标等元数据。

典型调用模式:

  • 快速事实核查:{"query": "事件 X 最新进展", "time_range": "week"}
  • 深度研究:{"query": "技术 Y 原理", "search_depth": "advanced", "max_results": 15}
  • 信源限定:{"query": "财报分析", "include_domains": ["sec.gov", "reuters.com"]}

关键参数建议:

  • 查询长度控制在 400 字符内,采用搜索引擎关键词而非自然语言长提示
  • 复杂主题拆分为多个子查询,优于单一冗长查询
  • 默认推荐 advanced 深度以获取更高精度结果

显著优点

1. LLM 原生优化:返回结构化的 JSON 结果,含相关性评分(score)、内容摘要、元数据,无需额外解析 HTML
2. 实时信息获取:弥补 LLM 训练数据截止时间的局限,支持检索当日/本周新闻

3. 细粒度控制:20 余项参数支持从泛化搜索到精准信源定位的全谱系需求

4. 低集成成本:单脚本封装,环境变量配置 API Key 后即可使用,无复杂依赖

潜在局限

  • 商业依赖:依赖 Tavily 第三方服务,存在 API 可用性与定价策略变更风险
  • 结果黑箱:搜索算法的相关性评分机制不透明,无法自定义排序逻辑
  • 内容完整性include_raw_content 为可选功能,可能受目标网站反爬策略影响
  • 速率限制:未披露具体配额,高并发场景需自行管理请求频率

适合人群

  • 需要为 AI Agent 集成实时搜索能力的开发者
  • 进行事实核查、来源验证的研究人员与内容创作者
  • 构建 RAG 系统、需动态检索外部知识库的工程师

常规风险

| 风险类别 | 说明 | 缓解建议 |
|---------|------|---------|
| API 密钥泄露 | `TAVILY_API_KEY` 以明文环境变量存储 | 使用密钥管理服务,避免提交至版本控制 |
| 搜索结果偏见 | Tavily 算法可能强化主流信源,边缘观点覆盖不足 | 显式配置 `include_domains` 引入多元来源 |
| 信息时效误判 | `time_range` 依赖网页标注时间,可能存在滞后 | 交叉验证关键信息的原始发布时间 |
| 合规边界 | 抓取某些域名可能违反 robots.txt 或服务条款 | 遵守目标网站的爬虫政策,敏感领域启用 `exclude_domains` |

Tavily Search 内容

scripts文件夹
agents文件夹
手动下载zip · 3.2 kB
openai.yamltext/plain
请选择文件