首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >大模型短板补齐:只能看图识字,如今 Claude 真正看懂完整视频

大模型短板补齐:只能看图识字,如今 Claude 真正看懂完整视频

作者头像
大盘鸡拌面
发布于 2026-09-15 19:27:47
发布于 2026-09-15 19:27:47
970
举报

claude-video:使Claude可以“看”到视频

这就很不直观了。

我想一想吧,人工智能可以看图片、读文字、听声音,但是当你给它看视频时,它却不能观看——因为视频很长,帧数很多,容纳不下。

Claude-video做的事情就是:你发送一个视频链接,说/Watch,它就会自动下载、抽取帧率、转换为文字,并把所有的信息打包后提供给Claude。那么Claude就可以“观看”该段视频了。

可以干什么呢?

把四十分鐘長的會議錄音剪輯成五個點子

你看到一个教程视频之后就直接提问“第三步怎么做”

查找监控录像上某一个时间点的情况

自己尝试过的最爽的一次体验是:在B站上有一个两个小时左右的专业课程,我把视频丢进去,在里面提问,“哪几部分适合我的程度?”然后它给我列出三个地方,我看了一下二十分钟左右就把问题解决了。节省了1个小时30分钟。

适合的人群为需要观看大量的视频、进行内容研究以及参加会议并产生怀疑的人。

地址为github:bradautomates/claude-video


本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-08-14,如有侵权请联系 cloudcommunity@tencent.com 删除
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档