产品简介
Deepstory 一款开源工具,利用GPT-2文本生成、TTS语音合成和角色动画技术,能将任意文字故事转化为由虚拟角色开口讲述的视频。它解决了将文字内容视觉化和有声化门槛高的问题,适合内容创作者和开发者快速生成故事视频。

核心功能
- 利用AI将文字/故事自动生成视频
- 角色会根据生成的文字语音进行口型动画
- 提供Web界面进行故事创作与管理
- 支持从现有文本或导入书籍续写故事
- 交互式生成模式,可分批编辑和添加句子
快速开始
- 从Google Drive下载完整项目文件与预训练模型。
- 安装依赖,并确保系统已安装ffmpeg及Python的ffmpeg库。
- 安装spacy英文模型后,运行项目即可通过Web界面使用。
界面预览


与其他方案对比
| 对比项 | Deepstory | 同类方案 |
|---|---|---|
| 生成方式 | 端到端自动化:输入文字,自动生成带语音和口型动画的完整视频。 | 通常需要分别进行文字转语音、动画制作、音视频合成等多个手动步骤。 |
| 内容可控性 | 支持基于已有文本续写和交互式批量生成调整,内容可控。 | 内容生成与视频化流程可能分离,调整需回到前期步骤。 |
适合谁用
- 需要将文字转化为动态角色讲述视频的内容创作者。
- 寻求AI辅助进行故事可视化原型制作的教育工作者或编剧。
下载与版本
当前最新版本为 master,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/thetobysiu/Deepstory