产品推荐 2026-07-22

VideOCR-GLM:AI识别多端使用的视频字幕提取工具

VideOCR-GLM 一款基于GLM-OCR AI技术的视频硬字幕提取工具。

开源软件Windows工具

产品简介

VideOCR-GLM 一款基于GLM-OCR AI技术的视频硬字幕提取工具。它能够自动识别并提取视频中内嵌的字幕,支持超过100种语言,提供可视化裁剪、批量处理等功能。主要面向需要处理大量视频字幕的内容创作者、研究人员及语言学习者。

VideOCR-GLM 主界面

核心功能

  • 交互式视频预览与视觉化字幕区域裁剪
  • 支持添加多个视频到队列并行处理
  • 基于WebSocket的实时处理进度显示
  • 支持100多种OCR识别语言
  • 提供Web界面、桌面应用和命令行三种使用方式

快速开始

  1. 下载并运行Windows桌面版安装程序。
  2. 确保本地Ollama服务已启动并拉取了glm-ocr模型。
  3. 在应用中打开视频文件,框选字幕区域并开始提取。

与其他方案对比

对比项本工具同类商业软件在线服务
费用开源免费通常收费或含广告可能有订阅或上传限制
隐私本地运行,数据自持依赖厂商政策需上传数据到服务器
可定制性源码开放,社区活跃受限于官方功能功能固定

适合谁用

  • 需要从视频中提取硬字幕进行二次创作的内容创作者
  • 处理外语教学视频或学术讲座录像的研究人员
  • 整理网课或会议录像中关键信息的学习工作者

下载与版本

当前最新版本为 v1.1.0,发布于 2026-03-27。支持 Windows。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。

注意事项

  • 本工具仅供学习和研究使用,请遵守相关法律法规。
  • 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
  • 项目源码地址:https://github.com/Benson-mk/VideOCR-GLM