
项目简介
mica-ppocr 是 [PP-OCRv6](https://github.com/PaddlePaddle/PaddleOCR) 文字检测与识别流水线的 Java 移植版,使用纯 [ONNX Runtime](https://onnxruntime.ai/) 推理,零 PaddlePaddle 依赖,完整复现预处理 / 后处理,移植自 `AIwork4me/ppocrv6_onnx` 的单文件 Python 参考实现,与 Python 版本保持 bit-exact。它是面向证件 / 票据 / 卡证场景的端到端识别方案,包含 OCR 核心 `mica-ppocr-core`、结构化解析 `mica-ppocr-structured`、Spring Boot Starter `mica-ppocr-spring-boot-starter`、Solon 插件 `mica-ppocr-solon-plugin`,全模块 Java 8 兼容,已发布到 Maven Central,坐标 `net.dreamlu:mica-ppocr-*`。
核心特性
具有零 Paddle 依赖、与 Python 参考 bit-exact、Java 8 全兼容、10 类内置结构化解析器、PDF 双通道、文档方向分类(可选)、按调用覆盖检测阈值、可视化友好、AI 协作原生支持等特性。
快速上手(Spring Boot 一行接入)
引入 starter,在 `application.yml` 中指定模型路径,Controller 直接调用即可。
已实现的结构化解析器
包括行驶证、身份证、银行卡等 10 类解析器,公共能力下沉在 `LabelMatcher`,新增自定义解析器只需实现 `BaseStructuredParser` 接口即可挂载到 `PPOcrTemplate`。
模型三档速览
有 `tiny`、`small`、`medium` 三档模型,各有特点,还有可选文档方向分类模型 `PP-LCNet_x1_0_doc_ori`。
版本更新汇总(v1.0.0 -> v1.2.3)
从 v1.0.0 到 v1.2.3 各版本有不同的功能新增、修复和重构等更新。
路线与计划
持续打磨已实现的 10 类结构化解析器精度与鲁棒性,跟进新模型,完善 PDF 双通道与文档方向分类边界场景,欢迎社区贡献。

417

被折叠的 条评论
为什么被折叠?



