X Read

🐦 免登录一键抓取X推文精华

无需登录即可抓取公开X/Twitter帖文内容,自动提取主帖、回复、媒体附件及卡片链接,以Markdown格式输出结构化摘要

收藏
4.5k
安装
1.4k
版本
1.0.1
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

x-read 是一款面向公开 X/Twitter 内容的只读抓取工具。用户只需提供完整的帖子 permalink(如 https://x.com/<user>/status/<id>),工具即通过 Puppeteer 启动沙盒化 Chromium 浏览器,模拟真实用户代理访问页面,无需 API 密钥或账号登录。

显著优点

1. 零门槛访问:绕过 X 的登录墙,直接抓取公开可见的帖文内容,解决了平台强制登录的痛点
2. 结构化输出:自动提取作者信息、时间戳、正文文本、媒体附件(图片/视频链接)及卡片链接,并以 Markdown 格式整理,便于后续处理或展示

3. 线程支持:不仅抓取主帖,还能捕获最多 3 条回复,适合快速理解讨论脉络

4. 媒体保真:保留 name=large 参数确保图片质量,输出标准 Markdown 图片语法 ![](...)

5. 安全只读:明确声明不执行任何写操作(发帖、点赞、私信、认证),纯读取行为降低风险

潜在局限

  • 公开内容限制:遇到登录拦截墙时直接报错,无法突破;私密账号、屏蔽内容不可访问
  • DOM 依赖脆弱性:核心逻辑依赖 X 的 data-testid 属性(如 tweettweetTextUser-Name),平台前端改版即可能失效
  • 性能开销:浏览器渲染相比 API 调用延迟较高(5-10 秒/URL),不适合高频批量抓取
  • 单链接处理:设计为逐链调用,不支持一次性处理动态信息流
  • 长文兼容性:部分长文章使用 article.content 结构,虽能追加提取,但解析一致性存疑

适合人群

  • 需要快速了解 Twitter 热帖但不愿/不能注册 X 账号的研究者、记者、分析师
  • 希望将社交媒体内容整合到 Telegram、Notion 等 Markdown 友好工作流的自动化用户
  • 关注公开舆论动态但注重隐私(避免平台追踪)的内容聚合者

常规风险

  • 服务稳定性:依赖 X 前端未改版,需持续关注 DOM 选择器维护
  • 反爬对抗:浏览器指纹识别、请求频率限制可能导致偶发访问失败
  • 内容时效性:抓取的是即时快照,原帖删除或修改后无法回溯

X Read 内容

手动下载zip · 18.8 kB
CHANGELOG.mdtext/markdown
请选择文件