Smart PDF Reader

📄 智能 PDF 阅读与精准内容提取

基于 MinerU API 的智能 PDF 阅读与内容提取工具,支持扫描件 OCR、表格识别、公式检测,适合学术研究、文档审阅与信息提取。

收藏
4k
安装
972
版本
0.2.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

Smart PDF Reader 是一款基于 MinerU API 的 CLI 工具,提供两种主要读取模式:

Flash Extract(极速模式):无需消耗 token,直接输出 Markdown 到 stdout,适合 10MB 以内、20 页以下的普通文档快速阅读。

Precision Extract(精准模式):启用 OCR、表格识别、公式检测,支持 VLM 模型,适合扫描件、学术论文、复杂排版文档。

显著优点

  • 零成本快速预览:flash-extract 模式不消耗 API token,适合日常快速查阅
  • 复杂文档处理能力:专为多栏学术论文、扫描档案、财务报表、法律文件优化
  • 多语言支持:可处理多语言混合内容
  • 结构化输出:提取内容保持原有文档结构(标题、表格、公式)
  • 自动化输出目录:默认生成 ~/MinerU-Skill/<name>_<hash>/ 便于管理

潜在缺点与局限性

  • 外部依赖:需安装 Node.js 及全局 npm 包,依赖 MinerU 服务可用性
  • 大文件门槛:flash-extract 有 10MB/20 页限制,超限需切换付费/消耗 token 的 extract 模式
  • 隐私风险:PDF 内容需上传至 MinerU 云端处理,敏感文档存在数据泄露隐患
  • 中文生态:官方 CLI 为英文界面,部分高级参数需查阅文档

适合人群

  • 学术研究者:快速提取论文核心内容
  • 法律/金融从业者:批量审阅合同、财报
  • 档案数字化工作者:处理历史扫描文档
  • 内容分析师:需要从 PDF 中提取结构化数据

常规风险

  • 数据隐私:避免上传含个人身份信息(PII)、商业机密或受版权保护的文档
  • 服务中断:依赖第三方 API,可能出现提取失败或延迟
  • OCR 误差:扫描件识别准确率受图像质量影响,关键内容需人工复核
  • 输出质量波动:复杂数学公式、手写内容可能识别不完整

建议将敏感文档先在本地脱敏处理,或优先使用 flash-extract 模式降低风险。

Smart PDF Reader 内容

手动下载zip · 2.4 kB
skill-card.mdtext/markdown
请选择文件