产品简介
voice-pro Voice-Pro是一个集成了YouTube视频下载、语音分离、语音识别、多语种翻译和文本转语音的AI Web应用。它解决了多媒体内容创作者在跨语言配音和语音处理中的需求,适合视频创作者、播客制作人和研究人员使用。

核心功能
- 集成YouTube视频下载与音频提取
- 支持零样本语音克隆技术(如F5-TTS、CosyVoice)
- 多语种文本转语音功能(如Edge-TTS、kokoro)
- 高精度语音识别系统(如Whisper)
- 即时多语言翻译服务(支持100+语言)
快速开始
- 下载程序:点击页面上的「下载软件」按钮获取。
- 运行程序:解压或安装后运行主程序。
- 开始使用:打开 voice-pro,按界面提示操作。
界面预览


与其他方案对比
| 对比项 | voice-pro | 同类方案 |
|---|---|---|
| 功能集成度 | 一站式集成下载、语音克隆、翻译等多功能 | ElevenLabs主要专注于语音合成服务,功能较单一 |
| 成本 | 完全免费开源 | ElevenLabs通常需要付费订阅 |
适合谁用
- 需要处理YouTube视频内容的视频创作者
- 进行多语种配音和翻译的播客制作人
- 研究AI语音识别技术的科研人员
- 开发者集成语音功能到应用
下载与版本
当前最新版本为 v4.0.0,发布于 2026-07-13。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/abus-aikorea/voice-pro