核心用法
bb-browser-sites 是一个文档型 Skill,指导用户使用 bb-browser 工具将 36 个主流互联网平台(103 条命令)转换为 CLI 操作。核心工作流为:
1. 初始化:bb-browser site update 拉取社区适配器
2. 查询:bb-browser site list/recommend/search 发现可用命令
3. 执行:bb-browser site <platform>/<action> [args] --openclaw 提取数据
关键参数:所有命令必须带 --openclaw 以使用 OpenClaw 内置浏览器,避免依赖外部 Chrome 扩展。
数据筛选:支持 --json 输出 JSON,或 --jq 'filter' 直接提取特定字段(如 .items[].name)。
登录态复用:适配器在 OpenClaw 浏览器标签页中运行,自动继承用户登录状态;未登录时返回 401 错误,需手动在浏览器完成登录后重试。
---
显著优点
- 覆盖全面:36 平台横跨社交(Twitter/Reddit/微博/小红书)、开发(GitHub/HN/StackOverflow/arXiv)、财经(雪球/东方财富)、视频(YouTube/B站)等 11 个品类
- 零插件架构:
--openclaw 直接调用内置浏览器,无需安装额外扩展或守护进程 - 结构化输出:原生支持 JSON + jq 过滤,便于管道化后续处理
- 会话继承:自动复用用户在 OpenClaw 浏览器中的登录态,支持需要身份验证的私有数据获取
- 社区生态:
site update 持续获取新适配器,可自定义创建新站点适配器
---
潜在缺点与局限性
- T3 来源:维护者 yan5xu 为个人开发者,非企业级背书
- 间接依赖:Skill 本身纯文档,实际安全取决于
bb-browser 工具及社区适配器的实现质量 - 浏览器风险:
--openclaw 模式直接操作用户真实浏览器会话,恶意适配器理论上可访问敏感页面 - 动态页面依赖:适配器基于网页 DOM 抓取,目标站点改版可能导致失效
- 无原生 API:依赖浏览器渲染而非官方 API,性能和稳定性低于原生接口
- 登录态隔离弱:与主浏览器的会话共享,建议敏感操作使用独立配置文件
---
适合人群
- 数据工程师/分析师:需要批量抓取社交媒体、财经、开发社区公开数据
- 自动化工作流用户:希望将网站信息获取集成到 shell 脚本或 CI/CD 管道
- 多平台监控需求:同时追踪 Twitter、Reddit、GitHub、雪球等多源信息的运营/研究人员
- CLI 重度用户:偏好终端操作,反感频繁切换浏览器标签页
---
常规风险
| 风险类型 | 说明 | 缓解措施 |
|---------|------|---------|
| 供应链风险 | 社区适配器未经审计 | 定期审查 `site update` 下载的适配器来源;优先使用知名平台适配器 |
| 会话劫持风险 | 适配器在登录态浏览器中运行 | 使用独立浏览器配置文件;避免在含敏感账户(网银、企业内网)的浏览器中执行 |
| 隐私合规风险 | 抓取用户生成内容可能违反平台 ToS | 遵守各平台 robots.txt 和服务条款;仅用于个人研究用途 |
| 数据质量风险 | 页面改版导致适配器失效 | 关注适配器更新;关键业务场景建议备用方案 |
安全等级 S 的依据:Skill 本身为纯 Markdown 文档,无可执行代码、无依赖、无数据收集,静态分析 95 分,隐私合规 100 分。风险主要集中于外部工具 bb-browser 及社区适配器的运行时行为。