产品简介
Talking_Face_Avatar Face Avatar 是一个开源工具,利用深度伪造技术,将静态肖像图片和音频转换为逼真的说话面部视频。适用于游戏开发者、动画师和内容创作者,用于快速生成角色头像或游戏资产,省去复杂动画制作流程。

核心功能
- 集成Leonardo.ai API生成艺术图像
- 集成ElevenLabs TTS API生成多语言音频
- 支持静态模式、参考模式、resize模式等多种视频生成模式
- 使用GFPGAN增强器提升视频画质
- 提供WebUI界面和命令行两种使用方式
快速开始
- 第一步:克隆GitHub仓库并进入目录
- 第二步:使用conda创建Python 3.8环境并安装依赖(如torch、torchvision)
- 第三步:运行脚本bash scripts/download_models.sh下载预训练模型
- 第四步:运行python app.py启动WebUI或使用inference.py命令生成视频
界面预览


与其他方案对比
| 对比项 | 本工具 | 同类商业软件 | 在线服务 |
|---|---|---|---|
| 费用 | 开源免费 | 通常收费或含广告 | 可能有订阅或上传限制 |
| 隐私 | 本地运行,数据自持 | 依赖厂商政策 | 需上传数据到服务器 |
| 可定制性 | 源码开放,社区活跃 | 受限于官方功能 | 功能固定 |
适合谁用
- 需要为游戏角色快速生成动态头像的游戏开发者
- 需要制作说话动画的动画制作者
- 想为虚拟形象添加语音互动的内容创作者
下载与版本
当前最新版本为 master,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/Yazdi9/Talking_Face_Avatar