web-search

🔍 多引擎实时搜索·智能故障切换

基于无头浏览器的多引擎实时搜索工具,覆盖全球18+搜索引擎,支持Google/Bing双引擎对照验证,自动故障切换至夸克AI,专为新闻、股价、时事等实时数据需求设计。

收藏
9.2k
安装
3.1k
版本
1.0.0
CLS 安全性认证2026-08-04
点击查看完整报告 >

使用说明

核心功能

web-search 是一个基于 Playwright/Puppeteer 无头浏览器技术的多搜索引擎聚合工具,专为获取实时网络数据而设计。支持 18+ 国内外主流搜索引擎,包括百度、Bing、360、搜狗、微信、今日头条、Google、DuckDuckGo、Yahoo 等,覆盖中英文搜索场景。

显著优点

1. 多源覆盖与智能聚合:单一接口覆盖国内外搜索引擎,内置 multi-search.js 实现 Google+Bing 双引擎对照搜索,智能去重合并结果,标记数据来源,有效降低单一引擎偏差风险。

2. 高可用性设计:核心亮点为自动故障切换机制——当 Google 访问失败时自动降级至夸克AI搜索,确保国内环境下的服务连续性。

3. 场景针对性强:特别标注适用于"最新新闻、时事、股票信息或其他需要实时网络数据的内容",对金融投资、舆情监测、行业研究等时效敏感场景价值突出。

4. 输出标准化:原生支持 Markdown/JSON 双格式输出,便于直接接入工作流或进行二次处理。

潜在局限与风险

1. 依赖稳定性问题:基于无头浏览器技术,受目标网站反爬策略、网络环境、IP 封禁影响较大,Google 在国内访问已标注为"不稳定"。

2. 维护成本高:需要持续维护 Playwright/Chromium 环境及搜索页面 DOM 解析逻辑,搜索引擎页面改版即可能导致失效。

3. 无内容深度:仅提取标题和链接,不抓取正文内容,需二次访问获取完整信息。

4. 合规灰色地带:大规模自动化搜索可能违反部分搜索引擎 ToS,存在账号/IP 封禁风险。

适合人群

  • 投资研究人员(实时股价、财经新闻追踪)
  • 舆情监测与公关从业者
  • 需要多源信息交叉验证的内容创作者
  • 中文互联网信息整合需求者

常规风险

  • S 级(网络/服务稳定性):依赖外部搜索服务可用性,存在访问波动
  • A 级(数据合规):需关注目标网站 robots.txt 及使用条款
  • B 级(准确性):搜索结果本身权威性需人工甄别,工具仅做聚合

安全解读

核心用法

Web Search Skill 是一款基于 Node.js 和 Playwright 无头浏览器的多搜索引擎聚合工具。用户通过命令行调用 search.jsmulti-search.js 脚本,指定搜索引擎和关键词,即可获取结构化的搜索结果。该技能支持 17 个搜索引擎,涵盖国内外主流平台,包括百度、Bing(国内/国际)、Google、360、搜狗、微信搜索、今日头条、夸克 AI 等。

单引擎搜索使用 node search.js <engine> <keyword> 命令,支持精确的引擎参数传递。多引擎对照搜索则通过 multi-search.js 实现 Google 与 Bing 的并行查询,具备智能去重、自动故障转移(Google 失败时切换至夸克 AI)、JSON/Markdown 双格式输出等高级特性。输出结果包含标题、链接及来源标注,便于后续处理。

显著优点

引擎覆盖全面:同时支持国内外主流搜索引擎,用户可根据网络环境灵活切换。国内环境推荐使用百度、Bing 国内版或夸克 AI;国际搜索则可选用 Google、DuckDuckGo、Brave 等隐私友好型引擎。

智能容错机制:多搜索模式内置故障转移逻辑,当 Google 访问受阻时自动降级至夸克 AI,显著提升可用性。这种设计特别适合国内用户的实际网络环境。

反爬虫对抗能力:集成 puppeteer-extra-plugin-stealth 插件,模拟真实浏览器指纹,有效绕过主流搜索引擎的反爬虫检测,保证搜索成功率。

输出格式友好:支持 Markdown 和 JSON 两种输出格式,便于直接阅读或接入自动化工作流。结果包含来源标记,方便追溯和验证。

潜在缺点与局限性

合规风险:使用 Stealth 插件绕过反爬虫检测可能违反部分搜索引擎的服务条款(ToS)。虽然技术层面可行,但存在账号封禁或 IP 限制的风险。此外,高频请求可能对搜索引擎基础设施造成负担。

稳定性依赖外部服务:该技能完全依赖第三方搜索引擎的页面结构。一旦目标网站改版(如 CSS 选择器变化),脚本将失效,需要开发者持续维护更新。相比之下,官方搜索 API 具有更好的稳定性保障。

隐私数据外泄:用户搜索关键词将被明文发送至多个外部服务(包括商业搜索引擎),存在被记录、分析甚至关联用户画像的风险。不适合用于搜索敏感商业信息、个人隐私或机密内容。

性能开销较大:无头浏览器启动和页面渲染消耗较多系统资源,相比纯 API 调用响应速度较慢,不适合高并发场景。

适合的目标群体

  • 信息研究员与分析师:需要跨平台比对信息、追踪舆情动态的专业人士
  • 内容创作者:寻找热点话题、收集素材的自媒体运营者
  • 金融投资者:查询实时股票、基金、财经新闻的个人投资者
  • 开发者与自动化工程师:需要将搜索能力集成至工作流的 Builder 用户
  • 普通办公用户:替代手动浏览器搜索,提升信息获取效率

使用风险

网络与隐私风险:所有搜索关键词均通过 TLS 加密传输至第三方服务器,但数据仍会被搜索引擎收集存储。建议避免搜索涉及商业机密、个人隐私或敏感政治话题的内容。

性能与资源风险:Playwright 依赖 Chromium 浏览器实例,内存占用较高(单实例约 100-300MB)。频繁调用可能导致系统资源紧张,建议控制并发数并及时清理浏览器进程。

依赖项风险:核心依赖 Playwright 和 stealth 插件,需保持更新以修复潜在安全漏洞。当前扫描未发现已知 CVE,但建议定期审计依赖版本。

服务可用性风险:国内访问 Google 不稳定,建议默认使用 Bing 或夸克 AI 模式。同时需关注目标搜索引擎的反爬虫策略变化,预留维护响应时间。

web-search 内容

scripts文件夹
手动下载zip · 16.3 kB
multi-search.jstext/javascript
请选择文件