核心用法
wechat-search-weread 是一套浏览器自动化方案,用于突破微信读书官方API对公众号文章搜索的限制(scope=2/4 返回-2041错误)。该skill通过agent-browser操作微信读书网页版,模拟真实用户行为完成搜索、滚动加载、URL提取全流程。
典型使用场景:当Exa、搜狗等常规搜索无法满足微信生态内容需求时,特别是需要获取微信公众号文章的原始mp.weixin.qq.com直链、完整元数据(标题/公众号/发布时间/简介)时启用。
显著优点
1. 唯一可行路径:官方API明确不支持公众号文章搜索,本方案是当前技术条件下的唯一解
2. 数据完整度高:可返回标题、公众号名称、发布时间、文章简介、原始链接全套字段
3. 结果规模较大:通过滚动策略可加载至500条结果上限
4. 链接质量优:提取的是微信官方mp.weixin.qq.com直链,非缓存或转码版本
潜在缺点与局限性
1. 架构脆弱性:依赖浏览器自动化、CDP协议、页面eval执行,任一环节升级都可能失效
2. 操作门槛高:5步流程缺一不可,涉及WSL端口转发、QR扫码、session保持、多标签页管理等复杂操作
3. 环境依赖重:需预装agent-browser、首次扫码登录、特定目录权限(/tmp)
4. 稳定性风险:weread标签页关闭即导致滚动中断、QR码过期、长滚动前台卡死等5类核心陷阱
5. 速率受限:滚动加载依赖XHR触发,大规模提取耗时较长(需600s timeout配置)
适合人群
- 需要获取微信公众号历史文章原始链接的研究者、媒体人
- 已有agent-browser基础设施、熟悉CDP调试的技术团队
- 对微信生态内容有深度挖掘需求,且可接受维护成本的数据分析师
常规风险
- 账号风险:高频自动化操作可能触发微信风控
- 数据一致性:页面结构变更将导致提取逻辑失效
- 隐私泄露:扫码登录过程产生临时文件需及时清理(/tmp/weread_qr.png)
- 会话过期:长期未使用需重新登录