产品简介
whisply 是一个基于 OpenAI Whisper 的音视频转录、翻译、标注和字幕生成工具。它支持 Windows、macOS 和 Linux,能根据硬件自动选择最快实现(CPU、Nvidia GPU 或 Apple MLX),适合需要高效处理音视频内容的用户,如内容创作者和翻译人员。

核心功能
- 根据硬件自动选择最快 Whisper 实现
- 支持单词级说话人标注和字幕生成
- 批量处理音视频文件、文件夹或 URL
- 提供命令行界面和浏览器应用
- 支持多种导出格式如 JSON、SRT、TXT
快速开始
- 安装 FFmpeg 依赖
- 创建 Python 虚拟环境并安装 whisply
- 运行 'whisply run' 命令开始转录任务
- 可选启动 'whisply app' 浏览器应用
界面预览
与其他方案对比
| 对比项 | whisply | 同类方案 |
|---|---|---|
| 硬件支持 | 支持 CPU、Nvidia GPU、Apple MLX,自动优化性能 | 可能仅支持单一硬件或需要手动配置 |
| 功能集成度 | 集成转录、翻译、说话人标注和字幕生成 | 可能需要多个工具分别处理 |
适合谁用
- 需要批量转录音视频的媒体工作者
- 制作字幕的视频创作者
- 使用 Apple M1-M5 或 Nvidia GPU 追求高性能的用户
下载与版本
当前最新版本为 v0.14.1,发布于 2026-05-21。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/tsmdt/whisply