产品推荐 2026-07-28

TextrolSpeech:免费的语音合成数据集工具(源码)

TextrolSpeech 是一个用于文本风格控制的开源语音合成数据集。

开源软件跨平台工具

产品简介

TextrolSpeech 是一个开源的语音语料库,专注于文本风格控制。它提供多样化的语音样本,支持情绪、节奏等风格调整,适用于 TTS 模型的研究和开发。解决数据稀缺问题,适合 AI 语音研究者、开发者和相关学习者使用。

核心功能

  • 开源语音和文本数据下载
  • 支持多种语音风格控制(情感、节奏、音高)
  • 文本风格可转换,单样本可生成500种风格
  • 数据标准化处理,统一采样率
  • 适用于 codec 语言文本到语音模型

快速开始

  1. 下载程序:点击页面上的「下载软件」按钮获取。
  2. 运行程序:解压或安装后运行主程序。
  3. 开始使用:打开 TextrolSpeech,按界面提示操作。

界面预览

与其他方案对比

对比项本工具同类商业软件在线服务
费用开源免费通常收费或含广告可能有订阅或上传限制
隐私本地运行,数据自持依赖厂商政策需上传数据到服务器
可定制性源码开放,社区活跃受限于官方功能功能固定

适合谁用

  • 需要训练文本风格控制 TTS 模型的 AI 研究人员
  • 需要多样化语音数据的语音开发者
  • 学习语音合成技术的学生

下载与版本

当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。

⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。

注意事项