产品简介
pycorrector 一个用于中文文本纠错的Python工具包。它能识别并修正音似、形似以及语法类错误,特别适合有大量中文文本校对需求的内容创作者、编辑及开发者,开箱即用。

核心功能
- 支持纠正音似、形似、语法、专名等多种中文错误类型
- 集成Kenlm、MacBERT、T5、ChatGLM3、Qwen2.5/Qwen3等多层次纠错模型
- 提供从统计模型到前沿大模型的完整解决方案
- 内置在线Demo和Gradio示例,便于快速体验和本地部署
- 针对不同业务场景(如输入法、OCR、搜索引擎)提供纠错能力
快速开始
- 通过命令 `pip install pycorrector` 安装库。
- 访问官方在线Demo或HuggingFace Demo页面快速体验纠错效果。
- 本地运行示例代码(如 `python examples/macbert/gradio_demo.py`)启动本地Gradio演示。
界面预览


与其他方案对比
| 对比项 | pycorrector | 同类方案 |
|---|---|---|
| 模型集成度 | 内置从Kenlm统计模型到MacBERT、T5、ChatGLM3、Qwen2.5等多种先进模型,提供完整选择 | 通常仅支持单一模型或少量模型 |
| 最新技术应用 | 快速跟进并集成Qwen2.5、Qwen3等最新大语言模型用于纠错 | 可能依赖较旧的模型架构 |
| 开箱即用程度 | 提供明确的示例、在线Demo和Gradio演示,便于快速上手 | 可能需要较多配置或自行寻找测试数据 |
适合谁用
- 需要优化中文文章、稿件内容质量的作家与编辑
- 在语音识别、OCR(光学字符识别)后进行文本校对的产品开发者
- 处理搜索引擎Query、用户评论等非规范文本的数据处理工程师
下载与版本
当前最新版本为 1.0.0,发布于 2023-11-07。支持 Linux。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/shibing624/pycorrector