首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >阅读笔记:DocOCR-Eval: A Correction-Based Framework for OCR Tool Selection Without Ground Truth

阅读笔记:DocOCR-Eval: A Correction-Based Framework for OCR Tool Selection Without Ground Truth

作者头像
用户8729876
发布2026-08-02 00:42:38
发布2026-08-02 00:42:38
840
举报
概述
这篇论文用 "MLLM 当 corrector、衡量 OCR 原始输出与校正后输出的差异" 的思路,提出一个无需人工标注的 OCR 引擎选择框架 DocOCR-Eval:对每个候选引擎的输出依次跑三阶段错误诊断(字符噪声 DcD_cDc​/ 分词错误 DtD_tDt​/ 语义一致性 DsD_sDs​)并条件触发两个 MLLM 校正器(纯文本 CtC_tCt​/ 带视觉裁剪重识别 CvC_vCv​)

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档