产品简介
pdf-narrator PDF Narrator是一款开源工具,能将PDF和EPUB文档智能提取文本并转换为自然有声书,支持Windows、macOS和Linux平台,适合需要将文档转为音频方便聆听的用户,尤其适合低资源系统环境。

核心功能
- 智能文本提取:支持PDF和EPUB格式,自动跳过页眉页脚
- Kokoro TTS集成:使用Kokoro v1.0模型生成自然语音
- 用户友好GUI:现代界面支持暂停/恢复生成
- 低资源系统优化:可调整文本块大小,支持CPU运行
- 语音测试功能:直接在应用中测试单个或所有语音
快速开始
- 克隆仓库并安装Python依赖:git clone和pip install -r requirements.txt
- 启动应用:运行python main.py
- 在GUI中选择PDF或EPUB文件并配置语音设置
- 点击开始生成有声书并等待完成
界面预览
与其他方案对比
| 对比项 | pdf-narrator | 同类方案 |
|---|---|---|
| 文本提取智能性 | 自动跳过页眉页脚,支持基于目录或HTML结构分割章节 | 同类工具可能需要手动提取或调整文本 |
| 系统资源要求 | 支持低显存系统,可切换CPU运行,高效处理 | 其他工具可能依赖高性能GPU或资源消耗较大 |
适合谁用
- 需要将文档转为音频的学术研究人员
- 喜欢听书但文档是PDF/EPUB格式的读者
- 处理大量文档需要音频版本的教育工作者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/mateogon/pdf-narrator