产品推荐 2026-07-28

tts-audiobook-tool:AI有声书制作工具(源

基于AI语音合成技术,将文本转换为高质量有声书的工具。

开源软件跨平台工具

产品简介

tts-audiobook-tool 一款专注于高质量输出的AI有声书制作工具。它支持多种前沿语音合成模型,能通过错误检测、长文本分段和音频优化等技术,可靠地批量生成长篇语音内容。内置音频同步阅读器,适合需要将文本转化为专业有声书的内容创作者、教育工作者和开发者。

核心功能

  • 集成多种前沿TTS模型(如Qwen3-TTS、OmniVoice等)
  • 通过语音转文本校验与重试机制提升生成可靠性
  • 支持长文本智能分段与音频降噪、静音修剪
  • EBU R128响度标准化与可选48kHz上采样
  • 内置浏览器播放器,实现文本与音频同步高亮显示

快速开始

  1. 设定一个工作项目目录。
  2. 选择一段参考音频进行声音克隆,并调整模型参数。
  3. 选择EPUB或文本源文件,并可设置分割点。
  4. 执行生成操作。
  5. 将生成的音频片段合并为成品有声书文件。

界面预览

与其他方案对比

对比项tts-audiobook-tool同类方案
支持的TTS模型数量集成包括Chatterbox、Fish Speech、Qwen3-TTS、OmniVoice等在内的十余种主流模型。同类工具通常仅支持一到两种特定模型。
可靠性保障机制采用语音转文本校验与重试逻辑,自动选择最准确的生成结果。通常缺乏针对生成不确定性的自动化校验与优化流程。
成品辅助功能生成的有声书自带同步文本数据,并提供免安装的浏览器同步阅读器。通常仅输出音频文件,不提供文本同步阅读体验。

适合谁用

  • 需要将文稿、书籍批量转换为有声内容的出版或教育从业者
  • 希望利用不同AI声音模型制作个性化有声书的播客或内容创作者
  • 需要测试和对比不同TTS模型效果的语音技术开发者

下载与版本

当前最新版本为 master,发布于 。支持 Windows、macOS、Linux。

⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。

注意事项