首页
学习
活动
专区
圈层
工具
发布

#ocr

DocClaw:让文档 Agent 记住自己刚刚读过哪里

用户8729876

💡 一句话总结:DocClaw 的贡献不是发明新 backbone,而是把文档任务差异放到技能层、把可复用知识放到状态层、把感知动作放到工具层;技能提升质量,状...

3900

腾讯云OCR × WorkBuddy:从DWG/PDF图纸直接生成设备台账skills最佳实践

用户12654912

设备台账,说白了就是全厂每台设备的"户籍册":位号、名称、规格、位置、监管类别,一台一行。它管三件事:账物一致(实物和记录对得上)、可追溯(检定记录、维修记录、...

25810

OmniHandwritingOCR:别让多模态大模型把手写公式读成幻觉

用户8729876

💡 一句话总结:OmniHandwritingOCR 用 77,572 个图像-标签对、6 个子任务和 12 个子集把手写 OCR 从“总分游戏”变成失败模式诊...

10100

跨页表格解析:第二页是续集还是新篇?

合合技术团队

做金融或财务相关开发的同学,大概率都处理过银行流水。一份流水 PDF 少则两三页,多则几十页,每页版式基本一样:顶部是账户信息,下面是交易明细,列着交易日期、摘...

9610

【工作篇-1】关于我用 WorkBuddy 10分钟就解决了几百份文件的命名噩梦,从此告别手动改文件名的崩溃

想吃布丁的月月

做工程/采购/材料的,谁没被几百份扫描件折磨过——解压出来要不然就是打印机默认的数字代码,要不然直接就是乱码,根本分不清哪份是哪份,手动改名能改到怀疑人生。

9810

1.2B 小模型赢过 235B 大模型:NaviDC-OCR 把文档解析卷明白了

用户8729876

💡 一句话总结:NaviDC-OCR 证明了在文档解析这条赛道上,"针对性的数据工程 + 训练配方"比堆参数量管用——1.2B 模型四大基准全第一,还顺手赢了一...

18710

错题反复出现的根源怎么找?错题归因算法解析:从OCR到知识图谱定位薄弱点

错题透镜

从学习科学的角度,归因的价值在于:单题订正修"这一题",归因定位修"这一类"(一个被广泛引用的研究综述指出,学习者对自身"薄弱处的结构"缺乏系统性认知,是元认知...

10400

非结构化数据处理:OCR + 大模型 + RPA,搞定文档、票据自动解析流转

用户12579380

上个月去朋友公司喝茶,财务主管老王拉着我吐槽:每天两千多张发票,四个人轮流转录,眼睛都看花了,出错还得返工。我瞄了一眼他的屏幕,ERP 系统里密密麻麻的表格,旁...

20110
领券