Wechat Search Weread

🔍 微信文章深度搜索与直链提取

绕过微信官方API限制,通过浏览器自动化搜索公众号文章,可获取500条结果及原始链接,适合深度内容挖掘

收藏
4.8k
安装
1.1k
版本
0.1.4
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

wechat-search-weread 是一套浏览器自动化方案,用于突破微信读书官方API对公众号文章搜索的限制(scope=2/4 返回-2041错误)。该skill通过agent-browser操作微信读书网页版,模拟真实用户行为完成搜索、滚动加载、URL提取全流程。

典型使用场景:当Exa、搜狗等常规搜索无法满足微信生态内容需求时,特别是需要获取微信公众号文章的原始mp.weixin.qq.com直链、完整元数据(标题/公众号/发布时间/简介)时启用。

显著优点

1. 唯一可行路径:官方API明确不支持公众号文章搜索,本方案是当前技术条件下的唯一解
2. 数据完整度高:可返回标题、公众号名称、发布时间、文章简介、原始链接全套字段

3. 结果规模较大:通过滚动策略可加载至500条结果上限

4. 链接质量优:提取的是微信官方mp.weixin.qq.com直链,非缓存或转码版本

潜在缺点与局限性

1. 架构脆弱性:依赖浏览器自动化、CDP协议、页面eval执行,任一环节升级都可能失效
2. 操作门槛高:5步流程缺一不可,涉及WSL端口转发、QR扫码、session保持、多标签页管理等复杂操作

3. 环境依赖重:需预装agent-browser、首次扫码登录、特定目录权限(/tmp)

4. 稳定性风险:weread标签页关闭即导致滚动中断、QR码过期、长滚动前台卡死等5类核心陷阱

5. 速率受限:滚动加载依赖XHR触发,大规模提取耗时较长(需600s timeout配置)

适合人群

  • 需要获取微信公众号历史文章原始链接的研究者、媒体人
  • 已有agent-browser基础设施、熟悉CDP调试的技术团队
  • 对微信生态内容有深度挖掘需求,且可接受维护成本的数据分析师

常规风险

  • 账号风险:高频自动化操作可能触发微信风控
  • 数据一致性:页面结构变更将导致提取逻辑失效
  • 隐私泄露:扫码登录过程产生临时文件需及时清理(/tmp/weread_qr.png)
  • 会话过期:长期未使用需重新登录

Wechat Search Weread 内容

references文件夹
scripts文件夹
手动下载zip · 22.2 kB
api-limitations.mdtext/markdown
请选择文件