产品简介
ocr_kor 用于韩文文档的OCR识别工具,通过深度学习优化句子级别识别,解决传统OCR准确率低的问题,适合研究人员、开发者和需要处理韩文文本的用户。

核心功能
- 自动生成韩文句子图像训练数据
- 支持多种深度学习模型组合(如TPS-VGG-BiLSTM-Attn)
- 提供训练、测试和演示脚本
- 包含实验结果对比不同模型性能
- 跨平台支持Windows、macOS、Linux
快速开始
- 第一步:在fonts/ko目录添加韩文字体文件(仅支持.ttf格式)
- 第二步:在dicts目录添加韩文单词词典
- 第三步:运行数据生成脚本(如generate_data_5type.sh)创建训练数据
- 第四步:使用create_lmdb_dataset.py脚本创建LMDB数据集
- 第五步:运行train.py或test.py命令进行模型训练或评估
界面预览


与其他方案对比
| 对比项 | ocr_kor | 同类方案 |
|---|---|---|
| 识别准确率 | 使用TPS-VGG-BiLSTM-Attn模型准确率达88.24% | 简单模型如RCNN-CTC准确率仅0.19% |
| 推理速度 | 部分模型推理时间在1-3毫秒 | 其他配置可能更慢(如ResNet模型6.84毫秒) |
适合谁用
- 需要处理韩文文档数字化的档案管理人员
- 开发韩文文字识别应用的软件工程师
- 研究深度学习OCR技术的科研人员
下载与版本
当前最新版本为 master,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/parksunwoo/ocr_kor