产品简介
ai-agent-video-editor 专为 AI 代理设计的对话驱动视频编辑工具。使用 ElevenLabs Scribe 进行字词级转录,自动生成编辑决策列表(EDL),并通过 ffmpeg 渲染最终视频。适合需要自动化视频处理的 AI 开发者和内容创作者,能提高编辑效率,减少手动操作。
核心功能
- 字词级转录支持说话人分离和音频事件识别
- 短语打包为 Markdown 格式,优化 LLM token 效率
- EDL 渲染流水线包含音频淡变、HDR 处理和字幕烧入
- 时间轴合成生成电影胶片和波形图辅助切割点选择
- 可选 Redis 缓存支持跨会话转录数据持久化
快速开始
- 克隆仓库并安装依赖:git clone 仓库后运行 npm install 和 npm run build
- 配置 API key:复制 .env.example 为 .env 文件,设置 ELEVENLABS_API_KEY
- 使用 CLI 命令进行视频操作:例如 npx video-use transcribe <视频> 转录,npx video-use render
渲染最终视频
界面预览
与其他方案对比
| 对比项 | ai-agent-video-editor | 同类方案 |
|---|---|---|
| 自动化程度 | AI 代理驱动,通过对话自动生成编辑决策,全流程自动化 | 传统视频编辑软件如 Premiere 需要大量手动操作,效率较低 |
| 集成能力 | 深度集成 LLM 和 CLI 接口,支持结构化文本输入和自评估 | 多数视频工具依赖图形界面,缺乏对 AI 工作流的原生支持 |
| 成本与开源 | MIT 许可证开源免费,支持跨平台运行 | 商业视频编辑软件通常收费,且可能有平台限制 |
适合谁用
- 需要集成视频编辑功能到 AI 系统的开发者
- 希望自动化处理视频素材以提高效率的内容创作者
- 使用 LLM 进行视频分析和编辑研究的研究人员
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/pifferologo/ai-agent-video-editor