产品简介
tts-audiobook-tool 一款专注于高质量输出的AI有声书制作工具。它支持多种前沿语音合成模型,能通过错误检测、长文本分段和音频优化等技术,可靠地批量生成长篇语音内容。内置音频同步阅读器,适合需要将文本转化为专业有声书的内容创作者、教育工作者和开发者。
核心功能
- 集成多种前沿TTS模型(如Qwen3-TTS、OmniVoice等)
- 通过语音转文本校验与重试机制提升生成可靠性
- 支持长文本智能分段与音频降噪、静音修剪
- EBU R128响度标准化与可选48kHz上采样
- 内置浏览器播放器,实现文本与音频同步高亮显示
快速开始
- 设定一个工作项目目录。
- 选择一段参考音频进行声音克隆,并调整模型参数。
- 选择EPUB或文本源文件,并可设置分割点。
- 执行生成操作。
- 将生成的音频片段合并为成品有声书文件。
界面预览
与其他方案对比
| 对比项 | tts-audiobook-tool | 同类方案 |
|---|---|---|
| 支持的TTS模型数量 | 集成包括Chatterbox、Fish Speech、Qwen3-TTS、OmniVoice等在内的十余种主流模型。 | 同类工具通常仅支持一到两种特定模型。 |
| 可靠性保障机制 | 采用语音转文本校验与重试逻辑,自动选择最准确的生成结果。 | 通常缺乏针对生成不确定性的自动化校验与优化流程。 |
| 成品辅助功能 | 生成的有声书自带同步文本数据,并提供免安装的浏览器同步阅读器。 | 通常仅输出音频文件,不提供文本同步阅读体验。 |
适合谁用
- 需要将文稿、书籍批量转换为有声内容的出版或教育从业者
- 希望利用不同AI声音模型制作个性化有声书的播客或内容创作者
- 需要测试和对比不同TTS模型效果的语音技术开发者
下载与版本
当前最新版本为 master,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/zeropointnine/tts-audiobook-tool