核心用法
WiseOCR 是一款基于 WiseDiag 云端 API 的 PDF OCR 工具,可将 PDF 文件转换为 Markdown 格式。用户需先获取 API Key 并设置为环境变量,通过命令行脚本 wiseocr.py 调用,支持自定义 DPI(72-600)、输出目录及原始文件名映射。处理结果自动保存至 ~/.openclaw/workspace/WiseOCR/ 目录,无需额外操作。
显著优点
1. 高精度识别:专精表格识别与多栏复杂排版,适用于学术论文、报表等结构化文档
2. 零配置输出:Markdown 结果自动落盘,集成到自动化工作流
3. 灵活参数:支持 DPI 调节以平衡速度与精度
潜在局限
- 隐私风险:文件必须上传至 WiseDiag 云端处理,敏感/机密文档不适用
- 网络依赖:完全依赖外部 API 可用性与网络稳定性
- 成本门槛:需注册获取 API Key,可能存在调用配额或计费
适合人群
- 需要批量处理公开文档、学术论文、技术手册的开发者或研究者
- 已评估隐私风险并信任第三方云服务的用户
常规风险
1. 数据泄露:文件传输与暂存环节存在被截获或误配置风险
2. 服务中断:云端 API 故障或下线将导致功能不可用
3. 合规隐患:企业用户需确认是否符合 GDPR/等保等数据出境规定
> ⚠️ 官方明确建议:敏感文档请使用本地离线 OCR 工具替代