核心用法
Smart PDF Reader 是一款基于 MinerU API 的 CLI 工具,提供两种主要读取模式:
Flash Extract(极速模式):无需消耗 token,直接输出 Markdown 到 stdout,适合 10MB 以内、20 页以下的普通文档快速阅读。
Precision Extract(精准模式):启用 OCR、表格识别、公式检测,支持 VLM 模型,适合扫描件、学术论文、复杂排版文档。
显著优点
- 零成本快速预览:flash-extract 模式不消耗 API token,适合日常快速查阅
- 复杂文档处理能力:专为多栏学术论文、扫描档案、财务报表、法律文件优化
- 多语言支持:可处理多语言混合内容
- 结构化输出:提取内容保持原有文档结构(标题、表格、公式)
- 自动化输出目录:默认生成
~/MinerU-Skill/<name>_<hash>/便于管理
潜在缺点与局限性
- 外部依赖:需安装 Node.js 及全局 npm 包,依赖 MinerU 服务可用性
- 大文件门槛:flash-extract 有 10MB/20 页限制,超限需切换付费/消耗 token 的 extract 模式
- 隐私风险:PDF 内容需上传至 MinerU 云端处理,敏感文档存在数据泄露隐患
- 中文生态:官方 CLI 为英文界面,部分高级参数需查阅文档
适合人群
- 学术研究者:快速提取论文核心内容
- 法律/金融从业者:批量审阅合同、财报
- 档案数字化工作者:处理历史扫描文档
- 内容分析师:需要从 PDF 中提取结构化数据
常规风险
- 数据隐私:避免上传含个人身份信息(PII)、商业机密或受版权保护的文档
- 服务中断:依赖第三方 API,可能出现提取失败或延迟
- OCR 误差:扫描件识别准确率受图像质量影响,关键内容需人工复核
- 输出质量波动:复杂数学公式、手写内容可能识别不完整
建议将敏感文档先在本地脱敏处理,或优先使用 flash-extract 模式降低风险。