核心用法
Tavily Search 是一个面向实时网络搜索与内容提取的 API 封装技能。用户通过配置 API 密钥,可直接调用 Tavily 的搜索引擎服务,支持从基础查询到深度研究的多层次检索需求。
主要功能模块:
- 基础搜索 (
search_depth: basic):快速获取 TOP 结果,适合日常查询 - 深度研究 (
search_depth: advanced):多源聚合与内容分析,适合学术与商业调研 - 智能摘要 (
include_answer: true):启用 AI 生成的结构化答案 - 内容提取 (
include_raw_content: true):获取目标网页完整正文
典型工作流:
1. 配置 API 密钥(环境变量或 openclaw.json)
2. 构造 POST 请求至 https://api.tavily.com/search
3. 使用 jq 解析 JSON 响应,提取 results 或 answer 字段
4. 按需启用 include_images 或 include_raw_content 扩展信息维度
显著优点
- 时效性强:直接对接实时索引,无传统爬虫的缓存延迟
- 结果结构化:返回包含标题、URL、摘要、得分、原始内容的规整 JSON
- 深度模式专业:
advanced模式会进行多轮检索与内容综合,接近研究助理级输出 - AI 摘要集成:可选 GPT 驱动的答案生成,减少人工筛选成本
- 配置轻量:仅需
curl+jq,无复杂依赖链
潜在缺点与局限性
| 维度 | 说明 |
|------|------|
| **付费门槛** | 需 Tavily API 密钥,免费额度有限,高频使用需订阅 |
| **网络依赖** | 完全依赖第三方服务,国内访问可能存在延迟或不稳定 |
| **结果不可控** | 搜索引擎排名算法黑箱,同一查询可能返回不同结果集 |
| **内容版权** | `include_raw_content` 抓取全文存在潜在的版权与合规风险 |
| **无本地缓存** | 每次查询均消耗 API 配额,无法离线复用历史结果 |
适合人群
- 知识工作者:需快速获取领域最新动态的研究员、分析师、记者
- AI 应用开发者:构建需要实时信息的 RAG(检索增强生成)系统
- 内容创作者:追踪热点话题、验证事实、收集素材的自媒体运营者
- 商业分析师:竞品监测、市场趋势扫描、政策跟踪
常规风险
1. API 密钥泄露:硬编码于配置文件的密钥可能被误提交至版本控制,建议优先使用环境变量
2. 配额耗尽未感知:未设置用量监控可能导致服务突然中断,建议集成响应状态码检查
3. 信息幻觉传导:Tavily 的 include_answer 虽由 AI 生成,但仍可能基于错误信源产生幻觉,关键决策需人工核验原始链接
4. 数据跨境传输:搜索请求与结果流经 Tavily 服务器(美国),敏感信息查询需注意合规边界