多格式电子书阅读与进度追踪工具,支持EPUB/PDF/TXT,整合公开域与灰色来源,适合AI辅助深度阅读与知识提取。
说明:
## 核心用法
**book-reader** 是一款面向AI代理设计的命令行电子书阅读工具,支持从Anna’s Archive、Project Gutenberg及本地文件读取EPUB、PDF、TXT格式书籍。核心工作流包括:搜索图书→下载到本地→分块阅读(带进度记忆)→生成摘要。进度数据持久化存储于`~/.openclaw/workspace/memory/reading-state.json`,支持书签、阅读笔记及断点续读。
### 显著优点
– **来源丰富**:整合Project Gutenberg(7万+公有领域书籍,完全合法)与Anna’s Archive(百万级灰色资源)
– **格式兼容广**:原生支持EPUB/PDF/TXT,依赖pandoc、pdftotext等成熟工具链
– **智能分块**:避免一次性加载大部头书籍,按页数/章节分段读取,适配LLM上下文限制
– **状态持久化**:自动记录当前书籍、已读页数、时间戳、书签与笔记,支持跨会话恢复
### 潜在缺点与局限性
– **法律风险**:Anna’s Archive涉及版权灰色地带,用户需自行承担本地法律合规责任
– **解析质量参差**:PDF OCR效果依赖源文件质量,EPUB转纯文本会丢失部分排版格式
– **无DRM支持**: intentionally 不处理受DRM保护的书籍,限制商业出版内容访问
– **性能瓶颈**:大型PDF解析速度较慢,未提及并行或索引优化
### 适合人群
– 研究人员与知识工作者:需批量提取、总结学术或专业书籍内容
– AI开发者:为Agent构建长期记忆与知识库,进行系统性学习
– 自学者:希望用AI辅助深度阅读、做笔记、跨书关联知识
### 常规风险
– **版权合规**:下载受版权保护书籍可能违反当地法律,尤其在未购买授权情况下
– **隐私暴露**:阅读状态与笔记存储于本地JSON文件,虽无云端上传,但文件权限管理不当可能导致敏感阅读记录泄露
– **来源可靠性**:Anna’s Archive作为影子图书馆,内容完整性、准确性无官方保障,可能存在篡改或恶意文件(虽文档未提及,但需警惕)
– **依赖维护**:依赖外部CLI工具(pandoc、poppler-utils)及Python库,版本漂移可能导致功能失效









