首页
学习
活动
专区
圈层
工具
发布
首页标签文字识别

#文字识别

精准、快速、多场景的图像文字识别服务

从 3.94 亿页书里捞出 2262 万个视觉元素

用户8729876

💡 一句话总结:这篇报告把书籍视觉元素当作一等数据对象,用轻量检测、分类、去重和可选 caption 组成可审计管线,在 Harvard Library 数亿页...

900

用 Node.js + 浏览器端 Tesseract.js 从零搭建「高拍仪申请单自动归档系统」

李迷

需求背景:单位每天要录入大量纸质申请单,传统方式是人工拍照、手工命名、手动归档到文件夹,效率低且容易出错。本文记录我如何用 Node.js + 浏览器端 OCR...

1500

把 8300 万个报纸版面单元变成可查询对象

用户8729876

💡 一句话总结:这条管线把历史报纸从“页图加 OCR 噪声”改成 crop 级结构化数据;每个 crop 挂着文本、类型、语言、实体、主题、顺序和向量,研究者可...

9110

如何利用 AI 技术实现把银行对账单转为 excel 格式

诸葛子房

在财务记账、企业对账、税务申报、审计核查等日常工作中,银行对账单是核心财务凭证。目前绝大多数银行对账单均为PDF、图片、纸质扫描件格式,传统人工录入、普通格式转...

18110

车队车辆信息智能核验:CodeBuddy 串联行驶证 OCR + 车牌识别双 Skill 落地(核验耗时从 5 分钟压到 8 秒)

行者全栈架构师

摘要: 这篇是我作为物流平台技术负责人,用 CodeBuddy CLI 把腾讯云两个 OCR Skill(tencentcloud-ocr-vehiclelic...

25712

用 WorkBuddy 拆分合并PDF:118页诉讼资料一键拆分为独立文书

用户12693105

上一篇文章里我提到用 WorkBuddy 整理案卷文件、按时间排序命名。但整理过程中发现了一个新问题:有份118页的PDF文件,里面合并了10份不同的法院判决书...

15610

用 WorkBuddy 整理案件卷宗:从零散材料到规范归档的实操记录

用户12693105

我从事律师行业,主做建设工程和争议解决诉讼。手头有个案子涉及多起关联诉讼,当事人交付的案卷材料散落在多个文件夹里——判决书、裁定书、证据材料、庭审笔录混在一起,...

13410

2026 年多渠道网络钓鱼攻击演化特征、识别机制与全域防御体系研究

芦笛

中国互联网络信息中心 | 工程师 (已认证)

网络钓鱼作为依托社会工程学实施的主流网络攻击手段,不依赖系统底层漏洞,通过伪造可信主体身份诱导目标主动泄露账号、金融、身份敏感数据,已成为引发数据泄露事件的核心...

14010

相关产品

  • 文字识别 OCR

    支持印刷体、手写体及定制化场景的图片文字识别服务,有效提升信息录入效率

  • 文字识别

    精准、快速、多场景的图像文字识别服务

领券