产品简介
ComfyUI-OmniVoice-TTS 这是ComfyUI的一个扩展插件,提供文本转语音功能,支持600多种语言,无需训练即可克隆声音或创建合成语音。适合视频配音、有声读物制作等场景,解决多语言语音生成和声音定制的痛点。

核心功能
- 支持600多种语言
- 零样本语音克隆(从3-15秒音频)
- 语音设计(通过文本描述创建声音)
- 多说话人对话生成
- 快速推理(RTF低至0.025)
快速开始
- 在ComfyUI Manager中搜索“OmniVoice”并点击安装
- 或手动克隆仓库到ComfyUI/custom_nodes并运行安装脚本
- 重启ComfyUI后使用提供的TTS节点生成语音
界面预览
与其他方案对比
| 对比项 | 本工具 | 同类商业软件 | 在线服务 |
|---|---|---|---|
| 费用 | 开源免费 | 通常收费或含广告 | 可能有订阅或上传限制 |
| 隐私 | 本地运行,数据自持 | 依赖厂商政策 | 需上传数据到服务器 |
| 可定制性 | 源码开放,社区活跃 | 受限于官方功能 | 功能固定 |
适合谁用
- 需要多语言配音的视频创作者
- 想克隆特定声音的播客制作者
- 使用ComfyUI进行AI语音生成的开发者
下载与版本
当前最新版本为 v0.4.7,发布于 2026-06-11。支持 Windows、macOS、Linux。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/Saganaki22/ComfyUI-OmniVoice-TTS