Book Reader - Learn & Grow Every Day

📚 AI驱动的智能书架与阅读伴侣

多格式电子书阅读与进度追踪工具,支持EPUB/PDF/TXT,整合公开域与灰色来源,适合AI辅助深度阅读与知识提取。

收藏
9.6k
安装
2.4k
版本
1.0.0
CLS 安全性认证2026-08-10
点击查看完整报告 >

使用说明

核心用法

book-reader 是一款面向AI代理设计的命令行电子书阅读工具,支持从Anna's Archive、Project Gutenberg及本地文件读取EPUB、PDF、TXT格式书籍。核心工作流包括:搜索图书→下载到本地→分块阅读(带进度记忆)→生成摘要。进度数据持久化存储于~/.openclaw/workspace/memory/reading-state.json,支持书签、阅读笔记及断点续读。

显著优点

  • 来源丰富:整合Project Gutenberg(7万+公有领域书籍,完全合法)与Anna's Archive(百万级灰色资源)
  • 格式兼容广:原生支持EPUB/PDF/TXT,依赖pandoc、pdftotext等成熟工具链
  • 智能分块:避免一次性加载大部头书籍,按页数/章节分段读取,适配LLM上下文限制
  • 状态持久化:自动记录当前书籍、已读页数、时间戳、书签与笔记,支持跨会话恢复

潜在缺点与局限性

  • 法律风险:Anna's Archive涉及版权灰色地带,用户需自行承担本地法律合规责任
  • 解析质量参差:PDF OCR效果依赖源文件质量,EPUB转纯文本会丢失部分排版格式
  • 无DRM支持: intentionally 不处理受DRM保护的书籍,限制商业出版内容访问
  • 性能瓶颈:大型PDF解析速度较慢,未提及并行或索引优化

适合人群

  • 研究人员与知识工作者:需批量提取、总结学术或专业书籍内容
  • AI开发者:为Agent构建长期记忆与知识库,进行系统性学习
  • 自学者:希望用AI辅助深度阅读、做笔记、跨书关联知识

常规风险

  • 版权合规:下载受版权保护书籍可能违反当地法律,尤其在未购买授权情况下
  • 隐私暴露:阅读状态与笔记存储于本地JSON文件,虽无云端上传,但文件权限管理不当可能导致敏感阅读记录泄露
  • 来源可靠性:Anna's Archive作为影子图书馆,内容完整性、准确性无官方保障,可能存在篡改或恶意文件(虽文档未提及,但需警惕)
  • 依赖维护:依赖外部CLI工具(pandoc、poppler-utils)及Python库,版本漂移可能导致功能失效

安全解读

核心用法

book-reader 是一款专为AI Agent设计的智能书籍阅读工具,支持从多种来源获取和阅读全本图书。主要功能包括:通过search命令检索Project Gutenberg等公共领域书库;使用download命令下载指定书籍到本地;利用read命令进行分段阅读并自动生成摘要;通过status命令随时查看阅读进度和书签。工具采用智能分块技术,将长篇内容拆分为易消化的阅读单元,支持从指定页面续读,实现无缝的阅读体验管理。

显著优点

多源整合能力:原生集成Project Gutenberg官方API(7万+公共领域书籍)和Anna's Archive影子图书馆,同时支持本地EPUB/PDF/TXT文件,覆盖广泛的阅读需求。

格式兼容全面:支持EPUB、PDF、TXT三种主流电子书格式,通过pandoc或Python ebooklib实现EPUB解析,pdftotext处理PDF文本提取,适配不同场景的技术栈。

智能进度管理:在本地工作目录维护reading-state.json状态文件,记录当前书籍、总页数、已读进度、时间戳和书签笔记,实现跨会话的阅读连续性。

隐私优先设计:所有阅读数据本地存储,不上传用户行为数据,符合GDPR/CCPA数据最小化原则,适合注重隐私的用户群体。

潜在缺点与局限性

版权合规边界:虽然Project Gutenberg内容完全合法,但Anna's Archive属于法律灰色地带,用户需自行判断当地法规。工具明确不支持DRM保护书籍,无法阅读受版权保护的付费内容。

解析质量波动:PDF OCR识别效果取决于源文件质量,扫描版PDF可能出现识别错误;EPUB转纯文本时格式信息丢失,复杂排版书籍的阅读体验可能降级。

外部依赖较重:需要安装poppler-utils、pandoc等系统工具,以及Python的ebooklib、beautifulsoup4库,在部分受限环境中部署门槛较高。

网络请求风险:支持用户直接提供任意URL下载,存在潜在的SSRF(服务器端请求伪造)风险,尽管这在功能设计上是预期行为。

适合的目标群体

研究人员与学者:需要批量获取公共领域学术著作、进行文献综述和知识提取的科研工作者;终身学习者:希望通过AI辅助高效阅读经典著作、构建个人知识库的自学人群;内容创作者:需要快速了解书籍核心观点、生成内容摘要的写作从业者;技术爱好者:愿意配置本地工具链、重视数据隐私的进阶用户。

使用风险说明

性能风险:大型PDF文件解析耗时较长,建议在阅读前预处理分割;依赖可用性:Project Gutenberg API偶尔存在访问限制,建议准备本地书籍备份;路径安全:虽然代码已使用basename处理用户输入,但仍建议避免在路径中包含敏感目录;内容验证:从用户指定URL下载时,务必确认来源可信,避免下载恶意文件。

Book Reader - Learn & Grow Every Day 内容

手动下载zip · 7.5 kB
book-reader.shtext/x-shellscript
请选择文件