搜索 - 腾讯云开发者社区-腾讯云

文章/答案/技术大牛

发布

来自专栏程序小小事
望言OCR视频字幕提取2025终极评测：免费版VS专业版提全方位对比(含免费下载)
一、产品定位：AI时代的视频字幕处理专家望言OCR作为专业的视频硬字幕提取工具，在AI视频处理领域占据重要地位。关注【程序视点】，回复ocr，获取免费下载地址！最后【程序视点】一直在助力提供更优秀、更高效的工具。关注【程序视点】，回复ocr，免费下载！后续小二哥会继续详细分享更多实用的工具和功能。
2.5K11编辑于 2025-07-27
来自专栏javascript趣味编程
2.5 node.js回首望
node.js是什么？上一小节2.4说过了，也就是一个可以脱离浏览器独立的javascript的运行时(runtime)。nodejs之父Ryan Dahl后来使用Go语言又开发了deno框架，被一个中国开发者疯狂吐槽，这feel似乎和我一些时候遭遇差不多，如下图：
84920发布于 2019-04-26
MySQL 9.0 创新版发布，大失所望。。
总结看了本次 MySQL 9.0 创新版的更新，说实话，大失所望。在这之前，网上有很多关于 MySQL 9.0 版本新特性的猜测，结果基本上都没有出现。
1.8K10编辑于 2024-07-05
来自专栏用户2442861的专栏
OCR material
：基于CNN的实现 blog: http://blog.xlvector.net/2016-05/mxnet-ocr-cnn/ I Am Robot: (Deep) Learning to Break github: https://github.com/tmbdev/clstm caffe-ocr: OCR with caffe deep learning framework github: https ://github.com/pannous/caffe-ocr Digit Recognition via CNN: digital meter numbers detection ? github(caffe): https://github.com/SHUCV/digit Attention-OCR: Visual Attention based OCR ? github: https://github.com/da03/Attention-OCR umaru: An OCR-system based on torch using the technique
14.5K41发布于 2018-09-19
来自专栏InvQ的专栏
CSDN 云IDE初体验 - 不负所望
云IDE产品介绍云IDE使用教程免费使用地址：点击【云IDE】，即可开始创建工作空间啦~
61420编辑于 2022-11-12
来自专栏我的小碗汤
十大 Docker 最佳实践，望君遵守！！
本文是关于容器安全的文章，展示了 10 种强化 Docker 基础架构并保护容器和数据免受恶意攻击的方法。
1.8K20编辑于 2023-03-19
OCR大全
OCR技术概述什么是OCR？OCR（OpticalCharacterRecognition，光学字符识别）是指将图像中的文字信息转换为计算机可编辑文本的技术。 OCR技术发展历程展开代码语言：TXTAI代码解释1960s-1990s:传统OCR时代└──基于模板匹配、特征提取2000s-2010s:机器学习OCR└──基于SVM、随机森林等算法2015-至今: 深度学习OCR└──基于CNN、RNN、Transformer2023-至今:大模型OCR└──基于多模态大模型(GPT-4V、Qwen-VL)OCR技术分类一、传统OCR方法1.基本原理传统OCR通常包括以下步骤 OCROCR具体实现1.传统OCR实现我们设计的是基于Tesseract的传统OCR示例代码。 ('image.jpg')#身份证识别result=ocr.id_card_ocr('idcard.jpg')#车牌识别result=ocr.license_plate_ocr('plate.jpg')
59110编辑于 2026-03-05
来自专栏Linux、云计算技术交流
前言
前言继Linux系统之后，本书中将开始介绍Linux企业级服务的部署。本书将先从网络参数设置讲起，逐一介绍各个服务的原理及部署方式。
60750发布于 2019-07-04
来自专栏平凡少年
OCR识别
最近作者项目中用到了身份证识别跟营业执照的OCR识别，就研究了一下百度云跟腾讯云的OCR产品接口。 1.腾讯云OCR ---- 收费：身份证OCR和营业执照OCR接口，每个接口每个月各有1000次的免费调用接口说明：身份证OCR接口 - https://cloud.tencent.com/document 2.百度OCR ---- 通过以下步骤创建OCR应用，作者当时在这一步花了很长时间 ? ? 创建完之后就可以拿到appId，API Key，Secret Key，就可以调用百度提供的api了收费：身份证OCR和营业执照OCR接口，每个接口每天各有500次的免费调用接口说明：身份证OCR 营业执照OCR接口- https://cloud.baidu.com/doc/OCR/OCR-API.html#.E8.90.A5.E4.B8.9A.E6.89.A7.E7.85.A7.E8.AF.86
27.3K52发布于 2019-04-11
来自专栏javascript趣味编程
[python从入门到放弃]pyautogui+acrobat去PDF水印一例
Adobe Acrobat（30天试用版）编辑模式打开PDF文件，关闭OCR识别。 ? Talk is cheap, show me the code! 都督阎公之雅望，棨戟遥临；宇文新州之懿范，襜帷暂驻。十旬休假，胜友如云；千里逢迎，高朋满座。腾蛟起凤，孟学士之词宗；紫电青霜，王将军之武库。家君作宰，路出名区；童子何知，躬逢胜饯。望长安于日下，目吴会于云间。地势极而南溟深，天柱高而北辰远。关山难越，谁悲失路之人？萍水相逢，尽是他乡之客。怀帝阍而不见，奉宣室以何年？嗟乎！时运不齐，命途多舛。冯唐易老，李广难封。临别赠言，幸承恩于伟饯；登高作赋，是所望于群公。敢竭鄙怀，恭疏短引；一言均赋，四韵俱成。请洒潘江，各倾陆海云尔：滕王高阁临江渚，佩玉鸣鸾罢歌舞。画栋朝飞南浦云，珠帘暮卷西山雨。
2.3K40发布于 2019-08-27
来自专栏晓谈岩说
五言排律
注： 1、排律：一般五言绝句通常为八句至十六句，也即二十或四十个字，也有超过这个长度的，一般称为排律或长律，有长达一百四十字的。 2、家酿：家里自酿的酒 3、流杯：犹流觞。 9、华星：明亮的星星原本是写一首五言绝句，感叹下繁忙的四月和初创的感受，但是写着写着就超标了，诗词吾爱校验不了了，一查，是从绝句转成了排律，诗词吾爱中似乎没有对排律的校验，那就自己看着弄吧，算是成就自己的第一首排律
35881编辑于 2023-08-29
来自专栏人工智能头条
望周知~
翻译 | 张涛出品 | 人工智能头条（公众号ID：AI_Thinker） 2014 年 RNN/LSTM 起死回生。自此，RNN/LSTM 及其变种逐渐被广大用户接受和认可。起初，LSTM 和 RNN 只是一种解决序列学习和序列翻译问题的方法（seq2seq），随后被用于语音识别并有很好的效果，比如 Siri，Cortana，Alexa 等；此外，这种技术在机器翻译领域也有应用，比如 Google Translate。 2015-2016 年，新的 ResNet 和 Attention 技术出现。实际上
1.5K60发布于 2018-06-05
来自专栏Mac应用教程
OCR Tool PRO Mac(OCR光学字符识别)
推荐这款OCR光学字符识别工具OCR Tool PRO，以卓越的准确性和速度从图像和 PDF 中提取文本。抓取图像 + PDF + 抓取屏幕区域 + 从 iPhone/iPad 捕获图像 + 设置 + OCR + 将文本复制到剪贴板 + 使用文本文件和 PDF 导出！ OCR Tool PRO Mac图片OCR Tool PRO版软件功能OCR 工具允许在选定区域中捕获具有任何文本的屏幕的一部分。它可以立即被识别并复制到剪贴板。 OCR 工具是一种简单、易于使用、超级高效且尊重您的隐私（不会从您的设备中获取数据）。主要特点抓取屏幕区域以实现超高效的 OCR多次抓取屏幕区域以快速工作从 iPhone/iPad 和扫描仪捕获图像以进行即时 OCR 并将结果复制到剪贴板。
20.5K20编辑于 2022-08-29
来自专栏目标检测和深度学习
OCR技术综述
最近入坑研究OCR，看了比较多关于OCR的资料，对OCR的前世今生也有了一个比较清晰的了解。所以想写一篇关于OCR技术的综述，对OCR相关的知识点都好好总结一遍，以加深个人理解。什么是OCR？比如汉王OCR，百度OCR，阿里OCR等等，很多企业都有能力都是拿OCR技术开始挣钱了。太多太多的应用了，OCR的应用在当今时代确实是百花齐放啊。 OCR的分类如果要给OCR进行分类，我觉得可以分为两类：手写体识别和印刷体识别。 OCR流程现在就来整理一下常见的OCR流程，为了方便描述，那就举文档中的字符识别为例子来展开说明吧。针对传统OCR解决方案的不足，学界业界纷纷拥抱基于深度学习的OCR。这些年深度学习的出现，让OCR技术焕发第二春。
16.5K92发布于 2018-04-18
来自专栏SIGAI学习与实践平台
OCR技术简介
OCR的应用场景根据识别场景，可大致将OCR分为识别特定场景的专用OCR和识别多种场景的通用OCR。比如现今方兴未艾的证件识别和车牌识别就是专用OCR的典型实例。 OCR的技术路线典型的OCR的技术路线如下图所示其中影响识别准确率的技术瓶颈是文字检测和文本识别，而这两部分也是OCR技术的重中之重。在传统OCR技术中，图像预处理通常是针对图像的成像问题进行修正。 [11] 端到端的OCR 与检测-识别的多阶段OCR不同，深度学习使端到端的OCR成为可能，将文本的检测和识别统一到同一个工作流中。 [12] 总结尽管基于深度学习的OCR表现相较于传统方法更为出色，但是深度学习技术仍需要在OCR领域进行特化，而其中的关键正式传统OCR方法的精髓。
18.8K20发布于 2018-09-26
DeepSeek-OCR-2 开源 OCR 模型的技术
DeepSeek-OCR-2开源OCR模型的技术OCR应用的场景和类型很广，本次使用Qwen2的架构，解决看的全（扫码方式优化）、看的的准（内容识别、视觉标记、降低重复率），多裁剪策略提取核心信息。 4.2GOT-OCR2.0：学术界的统一模型特点详情定位统一端到端OCR-2.0模型架构生成式预训练（类似LLM）特点强调整体文档理解适用场景学术研究、复杂版式文档对比结论：GOT-OCR2.0与DeepSeek-OCR VL是"通用选手"，OCR只是其能力之一；DeepSeek-OCR-2和HunyuanOCR是"OCR专家"，在文档解析专项上更精专。传统OCR-❌★☆☆☆☆极低简单文字识别五、选型建议：如何选择适合你的OCR方案5.1按应用场景选择场景推荐方案理由智能文档处理（IDP）HunyuanOCR/DeepSeek-OCR-2端到端，支持结构化输出移动端）：DeepSeek-OCR-2的上下文压缩特性可以显著降低文档预处理成本六、总结与展望DeepSeek-OCR-2和HunyuanOCR的开源，标志着OCR技术进入了一个新的阶段——从传统的"字符识别
76510编辑于 2026-02-07
来自专栏SIGAI学习与实践平台
OCR技术简介
OCR的应用场景根据识别场景，可大致将OCR分为识别特定场景的专用OCR和识别多种场景的通用OCR。比如现今方兴未艾的证件识别和车牌识别就是专用OCR的典型实例。 OCR的技术路线典型的OCR的技术路线如下图所示 ? 其中影响识别准确率的技术瓶颈是文字检测和文本识别，而这两部分也是OCR技术的重中之重。 Attention OCR的网络结构[11] 端到端的OCR 与检测-识别的多阶段OCR不同，深度学习使端到端的OCR成为可能，将文本的检测和识别统一到同一个工作流中。 FOTS的总体结构[12] 总结尽管基于深度学习的OCR表现相较于传统方法更为出色，但是深度学习技术仍需要在OCR领域进行特化，而其中的关键正式传统OCR方法的精髓。因此我们仍需要从传统方法中汲取经验，使其与深度学习有机结合进一步提升OCR的性能表现。
8.9K50发布于 2018-10-18
树莓派Raspbian系统安装tesseract-ocr实现OCR
第二步安装Leptonica sudo apt-get install libleptonica-dev 第三步安装tesseract sudo apt-get install tesseract-ocr
48910编辑于 2025-07-17
来自专栏Khan安全团队
OCR 转 XSS
光学字符识别 (OCR) 是从图像或任何文档（如 PDF）中以电子方式提取文本并以多种方式重复使用的过程，例如全文搜索、发票处理、文档验证等。我将tesseract用于 OCR 以及一个简单的烧瓶服务器，该服务器接受图像作为输入，它解析并将提取的内容反射回管理员或其他用户。你可以在这里找到代码。开始点击 python ocr.py 现在访问本地服务器 127.0.0.1:5000 上传以上文件现在访问 /admin/ocr/files 你会看到警报 image.png 同样，创建带有标签或盲 image.png 回复： image.png 修复：如果您使用 OCR 服务，不仅要使用文件名，还要在将图像或 pdf 中提取的文本存储到数据库之前对其进行清理。如果是，则可能在某个地方正在使用它，并且如果没有检查输出文本是如何反映的，那么它可能会导致 XSS，尤其是使用 OCR 服务的应用程序。
8.1K40编辑于 2022-02-17
来自专栏全栈程序员必看
Tesseract OCR初探
Refer from http://hellosure.github.io/ocr/2014/10/11/tesseract-ocr/ 11 October 2014 OPENCV & OCR ，光学字符识别），专注于字符识别 OCR工具收费 ABBYY Cloud OCR SDK确实很强大，但是试用版的有很多限制。开源开源的OCR工具还比较多，最流行也是Google支持的是Tesseract Tesseract简介 tesseact其实全称是tesseract-ocr，是个自动识别字符的程序，项目网址是：关于如何训练样本，Tesseract-OCR官网有详细的介绍http://code.google.com/p/tesseract-ocr/wiki/TrainingTesseract3。 tess-two-test为OCR的测试。
9.1K11编辑于 2022-07-25

第 2 页第 3 页第 4 页第 5 页第 6 页第 7 页第 8 页第 9 页第 10 页第 11 页

点击加载更多

望言OCR视频字幕提取2025终极评测：免费版VS专业版提全方位对比(含免费下载)

2.5 node.js回首望

MySQL 9.0 创新版发布，大失所望。。

OCR material

CSDN 云IDE初体验 - 不负所望

十大 Docker 最佳实践，望君遵守！！

OCR大全

前言

OCR识别

[python从入门到放弃]pyautogui+acrobat去PDF水印一例

五言排律

望周知~

OCR Tool PRO Mac(OCR光学字符识别)

OCR技术综述

OCR技术简介

DeepSeek-OCR-2 开源 OCR 模型的技术

OCR技术简介

树莓派Raspbian系统安装tesseract-ocr实现OCR

OCR 转 XSS

Tesseract OCR初探

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

望言OCR视频字幕提取2025终极评测：免费版VS专业版提全方位对比(含免费下载)

2.5 node.js回首望

MySQL 9.0 创新版发布，大失所望。。

OCR material

CSDN 云IDE初体验 - 不负所望

十大 Docker 最佳实践，望君遵守！！

OCR大全

前 言

OCR识别

[python从入门到放弃]pyautogui+acrobat去PDF水印一例

五言排律

望周知~

OCR Tool PRO Mac(OCR光学字符识别)

OCR技术综述

OCR技术简介

DeepSeek-OCR-2 开源 OCR 模型的技术

OCR技术简介

树莓派Raspbian系统安装tesseract-ocr实现OCR

OCR 转 XSS

Tesseract OCR初探

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

前言