产品推荐 2026-07-27

AudioBook-Maker:免费的文本转语音工具

利用先进语音克隆和文本转语音技术,将文本快速转化为专业有声书的桌面应用。

开源软件Windows工具

产品简介

AudioBook-Maker 这是一款基于Tauri 2.0构建的桌面应用,利用XTTS、Chatterbox等先进的文本转语音和语音克隆技术,帮助用户将文本一键转化为高质量有声书。它支持拖放式项目管理、17种以上语言、智能文本分段和多种音频格式导出,适合内容创作者、出版者或任何需要将长篇文本转换为专业音频的用户。

核心功能

  • 基于Docker容器一键部署,方便快捷
  • 支持将GPU计算任务卸载到远程服务器,提升生成效率
  • 可使用XTTS、Chatterbox等技术克隆和生成自定义语音
  • 支持导入Markdown或EPUB,并利用NLP智能分段文本
  • 可导出为MP3、M4A、WAV等多种音频格式

快速开始

  1. 从GitHub Releases下载并安装Windows版桌面应用
  2. 运行docker pull命令拉取后端容器镜像
  3. 执行docker run命令启动后端服务,映射端口和数据卷
  4. 启动桌面应用,连接至本地后端地址 http://localhost:8765
  5. 在应用设置中安装所需语音引擎并开始创建项目

界面预览

与其他方案对比

对比项AudioBook-Maker同类方案
语音生成技术集成XTTS、Chatterbox等前沿语音克隆技术,可创建高度定制的自定义语音。多数工具仅提供固定音色库,或仅支持基础的TTS转换,缺乏克隆能力。
部署与资源管理采用Docker容器化部署,支持将GPU引擎灵活分配到本地或远程服务器,便于资源扩展。通常需要本地安装复杂运行环境,且GPU计算能力绑定于本机,扩展性差。
文本处理与项目管理内置NLP智能分段,并提供项目、章节、段落的层级式拖拽管理界面。通常需要用户手动分段和组织,管理功能较简单或依赖外部编辑器。

适合谁用

  • 需要将小说、文档等长文本转为有声书的内容创作者和作家
  • 需要将教材、课程内容生成音频供学生收听的教师或教育机构
  • 拥有大量技术文档或报告,希望将其音频化以便收听的开发者与研究人员

下载与版本

当前最新版本为 v1.1.2,发布于 2026-01-04。支持 Windows。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。

注意事项