产品简介
caption_ocr_tool 一款用于提取视频硬字幕的工具,通过OpenCV处理视频图像并用Tesseract-OCR识别文字,支持HSV、HLS、二值形态学等多种滤镜过滤方法,适合视频编辑者和字幕制作者高效提取字幕。

核心功能
- 使用OpenCV进行视频图像处理
- 利用Tesseract-OCR识别文字
- 提供HSV、HLS、二值形态学过滤
- 支持滤镜调整和裁剪字幕区域
- 具备字幕管理、OCR识别和导出功能
快速开始
- 打开视频文件并点击滤镜,调整裁剪区域设置字幕位置
- 关闭滤镜后点击开始提取字幕,开启管理模式删除无效字幕
- 点击OCR识别字符或导出图像,校准文本后保存字幕文件
界面预览
与其他方案对比
| 对比项 | caption_ocr_tool | 同类方案 |
|---|---|---|
| 处理方式 | 本地运行,使用OpenCV和Tesseract,支持多种滤镜优化识别 | 在线工具需上传视频,可能有隐私风险且依赖网络 |
| 平台支持 | 跨平台支持Windows、macOS、Linux | 某些同类工具可能仅限单一操作系统 |
适合谁用
- 需要从视频中提取硬字幕的视频编辑者
- 制作字幕的字幕组成员
- 分析视频内容的研究人员或学生
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/sum1re/caption_ocr_tool