核心功能与用法
google-search 是一款基于 Google 双引擎架构的搜索技能,整合了 Gemini 2.5 Flash 的 Search Grounding 能力与 Custom Search JSON API 作为降级方案。提供三种互斥的工作模式:
- search(默认推荐):通过 Gemini 生成带编号的合成化答案,自动引用来源,适合问答、时事查询及需要直接结论的场景。支持 JSON 输出以获取置信度分数与结构化数据。
- raw:返回原始链接、标题与摘要,适用于研究、参考文献列表构建等需要精确 URL 的场景。
- image:调用图片搜索接口,返回图像 URL 与元数据。
配置通过环境变量管理,支持多语言(默认希伯来语 he)与区域定向(默认以色列 IL),命令行参数可覆盖全局设置。
显著优点
1. 双重引擎可靠性:主用 Gemini Grounding 提供语义理解,API 耗尽时自动降级至传统搜索,避免单点故障。
2. 希伯来语深度优化:默认语言设为希伯来语,文档与示例均体现对 RTL 语言的完整支持,填补多数搜索工具的多语言盲区。
3. 引用溯源机制:合成答案附带编号来源列表,降低幻觉风险,提升信息可信度。
4. 弹性配额管理:免费 tier generous,对轻中度使用友好;内置 429 自动重试与超时保护(30s)。
局限性与风险
- 配额天花板:Custom Search JSON API 免费版仅 100 次/日,高频场景需付费升级;Gemini API 虽免费 tier 宽松,但 RPM 限制(~15)仍可能制约并发。
- API 密钥依赖:需手动配置
GOOGLE_API_KEY与可选的GOOGLE_CSE_CX,首次部署门槛高于纯内置工具。 - 区域合规:默认定向以色列区域,跨国用户需显式覆盖
--country参数,否则可能获取地理偏差结果。 - 降级透明度:Quota 耗尽时 fallback 至 Perplexity 内置搜索,但此行为文档未明确用户是否感知,可能导致结果质量波动。
适合人群
- 希伯来语用户或需处理 RTL 语言的研究者
- 需要带引用答案而非纯链接列表的知识工作者
- 对 Google 生态有既有 API 配额、希望整合 Gemini 智能总结能力的开发者
安全评估
技能执行外部 HTTP 请求至 Google API,存在常规的网络层风险。代码以 Python 脚本形式通过 exec 工具调用,需确保 skills/google-search/lib/google_search.py 文件完整性。未观察到本地文件系统越界访问或敏感数据持久化行为。建议生产环境监控 API 密钥的权限范围(限制至 Search/Generative Language API 最小权限)。