产品简介
super-voice-assistant 一款专为macOS设计的语音助手,通过快捷键快速将语音或屏幕内容转录为文字。支持本地离线模型(WhisperKit/Parakeet)和云端API,能结合视觉上下文提高代码、术语等转录准确性,并支持将选中的文字朗读出来,适合追求高效文字输入的用户。
核心功能
- 语音实时转文字,支持本地离线或云端引擎
- 全局热键操作,录音和转录一键完成
- 屏幕录制并转录,结合画面内容提高准确率
- 选中文本即时朗读,支持流式语音合成
- 转录文本自动粘贴到光标处,并保存历史
快速开始
- 在终端执行 `git clone` 和 `cd` 命令下载仓库。
- 使用 `brew install ffmpeg` 安装依赖。
- 通过 `swift build` 编译项目,然后运行 `swift run SuperVoiceAssistant` 启动应用。
界面预览
与其他方案对比
| 对比项 | super-voice-assistant | 同类方案 |
|---|---|---|
| 运行方式 | 支持本地离线模型(Parakeet/WhisperKit)运行,无需网络,保护隐私。 | 多数在线转录服务需持续联网,数据经过服务器。 |
| 转录准确性 | 可通过屏幕录制+视觉上下文辅助识别,显著提升技术内容准确度。 | 普通语音转录工具对代码、专有名词等识别率较低。 |
| 操作效率 | 集成全局热键,在任何应用中一键启动/停止,文本自动粘贴。 | 通常需要切换到特定软件界面点击按钮操作。 |
适合谁用
- 需要快速将想法、会议或笔记转为文字的macOS用户。
- 进行技术演示、编写代码文档,需准确转录专业术语的开发者。
- 录制软件教程或屏幕讲解,希望同步生成文字稿的内容创作者。
下载与版本
当前最新版本为 v0.5.0,发布于 2026-01-29。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/ykdojo/super-voice-assistant