核心用法
Tavily Search 是一套面向 AI 代理设计的搜索引擎技能,提供四大核心能力:
1. 智能网页搜索:支持基础/高级/快速/极速四种搜索深度,可限定域名、时间范围、主题类型(通用/新闻/财经),并可选 LLM 生成直接答案。命令行工具封装完整,支持 JSON/Markdown 输出。
2. 内容提取:批量解析指定 URL,自动清理广告和无关元素,支持按关键词重排内容片段,可提取表格和嵌入内容,适合技术文档归档。
3. 整站爬取:智能遍历网站结构,支持自然语言指令、正则路径过滤、深度与广度限制,适合构建知识库或 API 文档集。
4. 深度研究:自动执行多轮搜索并整合信息,生成带引用的结构化研究报告,模型可选 mini/pro/auto,引用格式支持 MLA/APA/Chicago。
显著优点
- AI 原生设计:响应结构针对 LLM 输入优化,包含相关性评分、摘要、原始内容可选
- 实时性强:
topic: news配合time_range可获取当日新闻,弥补传统搜索时效滞后 - 成本控制清晰:基础搜索 1 信用点/次,免费 tier 1000 次/月,用量端点可监控消耗
- 企业级过滤:支持 300 个包含域名、150 个排除域名,以及国家/地区优先级设定
潜在局限
- 中文支持未明确:文档示例以英文为主,中文搜索效果需实际验证
- 深度研究耗时:30-60 秒延迟不适合实时交互场景
- 爬取风险:整站爬取若未设 limit,可能快速耗尽信用点;未配置 exclude 可能触发反爬机制
- 免费额度限制:1000 次/月对高频用户可能不足,需关注升级成本
适合人群
- AI Agent 开发者需要为 RAG 系统提供实时检索增强
- 投资/咨询从业者追踪实时新闻与行业动态
- 技术文档维护者批量提取并归档 API 文档
- 内容创作者进行多源信息整合与事实核查
常规风险
- API Key 泄露风险:
.env文件需妥善保管,避免提交至代码仓库 - 信息时效误判:
time_range依赖网页发布时间戳,可能存在标注误差 - 内容版权:提取和爬取的内容需遵守目标网站 ToS,商业用途注意合规
- 信用点超支:高级搜索、整站爬取、深度研究消耗更高,建议用量监控告警