mica-ppocr v1.2.3 发布,这是 PP-OCRv6 文字检测与识别流水线的 Java 移植版本,采用纯 ONNX Runtime 推理,不依赖 PaddlePaddle,并完整复现了预处理与后处理流程,包括 DB 后处理、CTC 解码以及等价于 pyclipper 的多边形 unclip 操作。该版本兼容 Java 8,移植自单文件 Python 参考实现,与 Python 版本保持 bit-exact 精度。其核心亮点在于内置 10 类证件与票据的结构化解析能力,使开发者能够在 Java 环境中直接完成 OCR 识别与字段抽取,无需引入 Python 生态。这一发布降低了 OCR 技术在 Java 项目中的集成门槛,为证件识别、票据处理等场景提供了轻量且可复现的工程化方案。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅