产品简介
AudioBook-Maker 这是一款基于Tauri 2.0构建的桌面应用,利用XTTS、Chatterbox等先进的文本转语音和语音克隆技术,帮助用户将文本一键转化为高质量有声书。它支持拖放式项目管理、17种以上语言、智能文本分段和多种音频格式导出,适合内容创作者、出版者或任何需要将长篇文本转换为专业音频的用户。
核心功能
- 基于Docker容器一键部署,方便快捷
- 支持将GPU计算任务卸载到远程服务器,提升生成效率
- 可使用XTTS、Chatterbox等技术克隆和生成自定义语音
- 支持导入Markdown或EPUB,并利用NLP智能分段文本
- 可导出为MP3、M4A、WAV等多种音频格式
快速开始
- 从GitHub Releases下载并安装Windows版桌面应用
- 运行docker pull命令拉取后端容器镜像
- 执行docker run命令启动后端服务,映射端口和数据卷
- 启动桌面应用,连接至本地后端地址 http://localhost:8765
- 在应用设置中安装所需语音引擎并开始创建项目
界面预览
与其他方案对比
| 对比项 | AudioBook-Maker | 同类方案 |
|---|---|---|
| 语音生成技术 | 集成XTTS、Chatterbox等前沿语音克隆技术,可创建高度定制的自定义语音。 | 多数工具仅提供固定音色库,或仅支持基础的TTS转换,缺乏克隆能力。 |
| 部署与资源管理 | 采用Docker容器化部署,支持将GPU引擎灵活分配到本地或远程服务器,便于资源扩展。 | 通常需要本地安装复杂运行环境,且GPU计算能力绑定于本机,扩展性差。 |
| 文本处理与项目管理 | 内置NLP智能分段,并提供项目、章节、段落的层级式拖拽管理界面。 | 通常需要用户手动分段和组织,管理功能较简单或依赖外部编辑器。 |
适合谁用
- 需要将小说、文档等长文本转为有声书的内容创作者和作家
- 需要将教材、课程内容生成音频供学生收听的教师或教育机构
- 拥有大量技术文档或报告,希望将其音频化以便收听的开发者与研究人员
下载与版本
当前最新版本为 v1.1.2,发布于 2026-01-04。支持 Windows。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/DigiJoe79/AudioBook-Maker