产品简介
macos-vision-ocr OS 专属的命令行 OCR 工具,基于 Apple Vision 框架。支持 JPG/PNG/WEBP 等格式,能识别中英日韩等16种语言,可单张或批量处理图片,并输出带置信度的文本位置 JSON 数据。适合开发者、需要批量处理图片文字或对 OCR 结果位置有要求的用户。

核心功能
- 支持 JPG/PNG/WEBP 等常见格式
- 单张处理与批量处理模式
- 支持中文、英文、日文等16种语言
- 输出包含文本位置与置信度的 JSON 结果
- 调试模式可在图片上绘制文本检测框
快速开始
- 确保已安装 Xcode 及 Command Line Tools。
- 克隆仓库代码并编译对应架构版本(arm64 或 x86_64)。
- 使用命令 ./macos-vision-ocr --img ./path/to/image.jpg 处理单张图片。
界面预览
与其他方案对比
| 对比项 | macos-vision-ocr | 同类方案 |
|---|---|---|
| 原生集成与隐私 | 基于苹果原生 Vision 框架,本地运行,隐私性好。 | 许多在线 OCR 服务需上传图片至云端,存在隐私风险。 |
| 批量处理与输出 | 支持目录批量处理,并可输出包含文本坐标、置信度的结构化 JSON。 | 一些命令行 OCR 工具可能批量能力弱或输出格式简单。 |
适合谁用
- 需要从扫描件或照片中提取文字内容并保留位置信息的开发者或数据工程师
- 需要批量识别图片中多语言文本(如中英混杂)的运营或研究人员
下载与版本
当前最新版本为 v0.0.2,发布于 2025-02-14。支持 macOS。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/bytefer/macos-vision-ocr