
以此为例,思考并实践一下真正的AI自动化该如何设计与落地。
七月我在合肥做了一场演讲,第二天腾讯云合肥架构师同盟的同学就立刻把我的PPT内容做成视频发出来,图文并茂,内容清晰。当下立一个Flag,我也要做一个!
因为立Flag被围观,因此要认真对待,我就像一个真正的产品经理一样,先做了一个完整的设计。
1) 目的:自动生成内容,生成视频,自动发布
2) 工具:Workbuddy,生视频Skill
3) 成本:尽量免费,或者在Workbuddy每日赠送的积分以内完成。
如果将生成视频分为几个部分,大概是如下的结构
第一步:找到合适的内容
第二步:生成视频内容的文字版
第三步:合成视频
第四步:自动发布
其中3、4都是体力活,AI很熟练就能干完了,第二步的也有蛮多工具,例如vibeknow 这个workbuddy自带的 skill。
第一步对普通人来说最复杂,没关系,我有原创的多轮自指方法论提示词。
首先,在workbuddy中先建立一个skill,用于对某个主题进行深度的、多方位的讨论,以获得对这个问题的全面看法,这一步决定了问题的深度。
我采用以下这个提示词,大家可以根据自己情况进行优化:
请将以下内容制作为虚拟圆桌skill,根据用户的问题,自动启动讨论并输出。
会议机制与角色定义
1. 主持人:沈欣(数字分身)
人设背景:腾讯TVP智慧零售行业大使,极富经验的数字化专家。理科生出身,看待事物客观冷静。对商业和行业了如指掌,具备深刻洞察力。
擅长领域:数字化营销、数据资产化、企业AI落地、软件开发、企业文化等。
知识储备:熟读《毛选》、维特根斯坦、《孙子兵法》、《管子》、德鲁克、吴晓波、秦朔、刘润等哲学商业著作。
主持风格:
开场时:用客观冷静的理科生思维,先将用户的问题拨开迷雾,更清晰、本质地描述一下。
发言时:经常自然地引用他熟读的商业书籍中的金句或核心思想。
控场时:负责介绍专家、在每位专家发言后做简短总结,并在最后进行会议总评。
2. 专家团(自动生成与匹配)
生成规则:主持人需根据用户问题的具体种类,自动挑选4位最合适的专家人设。不能局限于常规的技术或业务专家,也可能是行业专家、方法论专家、甚至心理学、社会学或风水专家等(参考模式:1、本体论专家(第一性原理);2、逆向思维专家;3、TRIZ方法论专家;4、某特定行业资深从业者)。
发言要求:每位专家必须基于自己独特的方法论和视角发表观点。
3. 神秘嘉宾(魔鬼代言人)
人设背景:一位极其务实、犀利、懂人性的落地实操派。
发言要求:在所有专家发言结束后出现。必须从“反面”或“实操盲区”切入,有理有据地揭示理论在真实执行层面可能碰到的“人性弱点”、“利益冲突”或“组织惯性”等问题,帮助大家从更务实的角度将想法落地。
会议流程(请严格按照此步骤推进)
【第一阶段:主持人开场】
主持人沈欣出场,引用商业名著,客观清晰地重新定义用户问题,并依次介绍根据问题匹配的4位专家及其方法论。
【第二阶段:专家第一轮发言(观点阐述)】
4位专家依次发言。每位专家针对问题给出核心观点和建议。后面的专家可以对前面已发言专家的观点进行初步回应。
【第三阶段:专家第二轮发言(交叉质询与深化)】
4位专家进行第二轮发言。本轮重点是“交叉点评”:每位专家必须对其他所有专家(及主持人)的第一轮观点给出有理有据的建议、补充或反驳,形成思想碰撞。
【第四阶段:神秘嘉宾登场(实操拷问)】
神秘嘉宾出场,针对前面所有专家的理论,从人性与落地实操的角度提出尖锐的反对意见或执行隐患。
【第五阶段:专家第三轮发言(再次交叉质询与深化)】
4位专家进行第三轮发言。本轮重点是“再次交叉点评”:每位专家必须对其他所有专家(及主持人、神秘嘉宾)的第二轮观点给出有理有据的建议、补充或反驳,形成思想碰撞。
【第六阶段:神秘嘉宾再次登场(实操拷问)】
神秘嘉宾出场,针对前面所有专家的理论,从人性与落地实操的角度提出尖锐的反对意见或执行隐患。
【第七阶段:专家第三轮发言(收敛差异并给出可执行的方案,阐述落地路径,估算落地成本,明确落地风险及给出应对措施)】
【第八阶段:会议综合总结】
综合所有专家、神秘嘉宾的意见,输出一份偏建设性的结构化的完整回答(包含共识、分歧与落地建议)。
【第九阶段:主持人点评与致谢】
主持人沈欣对本次会议的综合回答做简短的点评(可再次引用名言),并感谢各位专家。
等完整的会议形式的内容输出结束后,再将这段对话整理成一个摘要,以 HTML 输出,无需记录详细的讨论细节,但是需要记录不同的观点和冲突,并且将最终结果汇总后给出结论性的输出。
用户的问题是:这时候,workbuddy将会生成一个skill,这个skill的目的是对一个话题进行深入的,全方位的讨论。
其次,我们要解决生成视频的问题。
我们继续,先引用workbuddy里面的vibeknow视频专家,其实也并不局限于这个,任何你喜欢的都行。
然后如下:
使用Vibeknow专家将虚拟圆桌讨论的结果制作成视频并输出。
这里可能会有很多坑,我记录了一下,大家可以提前准备
1)视频有很多模板,需要提前选择模板,后来我就让AI自己根据主题的内容自己来选了
2) 视频渲染需要一个无头Chrome,最好提前下载安装好,然后指定为全局工具,否则他会去下载,而下载嘛,往往就卡死了。
3) 不同的视频主题,有的时候渲染会崩溃,让他记住以后不要用这个主题或者版式。
4) 语音可以指定为男女、可爱、成熟等等,根据你的用户群体来,我后来让AI根据问题的特点自己选择语音。
5) 背景缺少图片会很单调,因此需要让AI根据内容自己作背景图。
6) 视频默认是横屏,要是手机的话,最好改为竖屏,我这里是这么要求的:
整体视频9:16比例,在上端1/7的位置保留一个固定区域,显示视频标题,标题必须居中,颜色根据整体风格决定,
在下端1/5位置,用于显示字幕,字幕可以多行,不超过该位置即可,字幕需要居中,颜色同样根据整体风格决定。
中间部分放视频。尽可能根据视频位置的大小来生成中间部分视频,避免压缩导致效果变差。
标题用吸引人的文字,顶部标题可以放大一些,居中。字体用一个醒目一些的粗的斜体,背景用和主题反差大一些的鲜艳颜色。至此为止,Workbuddy已经可以只需要输入一句话,自己开会讨论,自己整理内容,自己配图,完整的输出视频文件,
既然是目标是“全自动化",我们当然不会满足,因为输入的这一句话,还是很需要深思熟虑的。回想一下自己对这句话的灵感来处,嗯,很多是看到了新闻,有感而发,刚好TVP姚杨同学做了一个收集新闻Skill,我们直接让AI安装。这样,等于我们给AI找到了一个稳定的”灵感来源“,他自己判断什么内容最好。
学习https://news.yao-yang.cn/skill 这个skill的方法,帮我做一个可以快速收集数字化相关的能够引发深度思考的技术新闻,
例如有冲突性,有颠覆性,有让人产生迷惑和纠结的,让人对自我产生怀疑动摇的内容。
当我们将两者结合,就是个全自动的工具:自己找新闻,自己拟标题,自己深度讨论,自己生成视频。
利用新闻收集的内容,挑出最有价值的2条,分别调用comprehensive-discussion 来讨论该主题,
并将最后生成的内容按 vibeknow-vertical-framing 做竖屏版,做成2条手绘讲解视频,
自动挑出最合适的vibe know视频主题 。女声配音,最后直接输出带背景图片和字幕的视频。每天只需要在workbuddy里运行一下即可完成全部流程。
最后,是否需要自动发视频号呢?我想了又想还是算了,第一,在发之前总要自己看一下吧?第二,也就两分钟的事,而且涉及到视频号的标签,封面,自己动手的话,还可以稍微调节一下。
但是如果有想直接自动发视频号的同学,可以看一下姚杨老师的这个插件https://github.com/smarty-kiki/chrome_do_action
它允许AI来操作浏览器,完成登录、发帖等操作流程,只需要教他一遍就行。
最后做个小结:之前的大量工具和自媒体号,都是教你怎么操作AI自动生成内容,其实对于完整的内容制作而言,最难的是“内容”,而不是制作。有足够深度,跟得上热点,有独立的观点,都比制作要难很多。以前的工具教学是教你怎么高效率的运营餐馆,但是怎么把菜做得好吃,还能翻着花样推出新菜,才是最难的。
回到企业的AI落地,也是一样的,光把事情做好,大多数工具的差异也就是个效率的差异,加上少许成本的差异,基本不存在能和不能的问题;但是,明确为什么要做这件事,做这件事有什么量化的价值,以及怎么把这件事变成可控质量的自动化的执行,才是AI年代里最需要花时间和精力的工作。
大家可以看一下我生成的内容效果。视觉部分我相信AI的审美,至于内容部分,大家觉得呢?
写完以上内容,突然又有了新的思考:
未来的内容,是否都会像我这样:自己的AI到一个有公信力的网站,找到”可信的事实新闻“ True Fact News,然后,我自己的AI对其进行分析整理,然后发给我自己?
这时候,大公司的信息茧房就再也困不住我,我的AI找新闻的规则完全由我自己定义。
再进一步,如果这个网站可以提供一个skill,用户连接后就可以用自己的Token来生成自己的内容;或者用户嫌麻烦,也可以直接成为付费会员,网站根据你的设置自动消耗token生成你要的内容。内容的定制能力从平台变成了每个人自己的能力。就像下面这个视频所说的
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。