首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >亲测被驳回 4 次后才懂:算法备案和"生成合成标识"是两件事

亲测被驳回 4 次后才懂:算法备案和"生成合成标识"是两件事

原创
作者头像
AI算法大模型备案当当
发布于 2026-09-08 09:23:55
发布于 2026-09-08 09:23:55
1950
举报

作者:一位把备案材料改到第 4 版才过审的算法安全责任人

先声明一句:我不是法务,也没有任何机构背景,只是一个把算法备案从零跑到拿号、又差点在"内容标识"上栽跟头的 SaaS 团队负责人。这篇文章把我在坑里爬出来的认知写清楚,希望后来者少走我走过的弯路。

一、备案号下来的那天,我以为这事就完了

我们的产品是园区场景的两个生成能力:营销文案生成和智能客服对话。功能本身平平无奇,但备案这条路我走了整整 8 个月,被驳回了 4 次——类目判错、材料口径打架、机制机理写得像天书,一次一次被退回重改。

备案号公示的那天,我长出一口气,觉得"合规这事"总算干完了。团队甚至已经把庆祝截图发进了群里。

然后我看到了 2026 年 2 月的一条新闻:网信部门督促平台集中处置了一批账号——13421 个账号,54.3 万余条信息。原因不是"没备案",而是发布 AI 生成内容时没有添加 AI 标识:用 AI 生成"狗在高铁站救下婴儿"的视频博流量、AI 换脸假冒公众人物发声、甚至有人在电商平台售卖"去 AI 标识"的教程和软件——后者的商品被直接下架。

我盯着"去 AI 标识教程被下架"这一条,忽然意识到一个被我忽略很久的事实:

算法备案批下来了,只代表"你申报的这个算法服务"被登记在册;而"生成的每一条内容都要打上 AI 标识",是另一套从上线第一天起、每天都在执行的独立义务。 两件事,我此前一直当成了一件事。

这篇文章就讲清楚这两件事到底哪里不同、为什么会混、以及 2026 年这个时间点上,第二件事已经紧到什么程度。

二、为什么会把两件事混成一件事

老实说,混淆不是我们的错,是这两套规则长得太像了:

  • 都叫"深度合成/生成合成"。一个叫"算法备案",依据《互联网信息服务深度合成管理规定》;另一个的依据是《人工智能生成合成内容标识办法》——名字里也全是"生成合成"。
  • 都围着同一个产品转。你做 AI 产品,上线前查合规,搜出来的东西一半在讲备案流程,一半在讲内容标识,铺天盖地。
  • 都在"上线前"这个时间点集中处理。我们当时的认知是:备案材料里写清楚"我们将按要求添加 AI 标识",这事就跟备案一起过关了。
  • 同一个监管出口。出了事,通报文件里依据的法规常常一串列下来:《生成式人工智能服务管理暂行办法》《互联网信息服务深度合成管理规定》《人工智能生成合成内容标识办法》——乍一看像是一部法的不同条款。

直到我把两份文件并排摊开逐条读,才看清:这是两个不同的制度设计,管的是两件不同的事。

三、第一件事:算法备案,管的是"你有没有在册"

算法备案的核心问题只有一个:谁,在用算法,对外提供信息服务?

它是"对事"的申报制管理。你把主体信息、算法信息、应用场景、机制机理、自评估报告交上去,网信部门审的是"这套算法机制的透明度、安全性和你这家主体的责任落实能力"。审过了,发你一个备案编号,在官网公示,你在产品显著位置把编号标出来。它管的是一个**"身份"**:你是合法登记在册的算法服务提供者或技术支持者。

几个特征决定了它的"一次性":

  • 按算法服务个数备案。一条算法一条记录,我们的文本生成和客服对话各备一条,各拿一个号。
  • 以"过审拿号"为终点。拿到编号、完成公示,这一轮就闭环了(算法机制发生重大变化时再走变更)。
  • 审查发生在你对外提供服务之前。它是"上线准入门槛"逻辑。

我们被驳回 4 次的,都是这第一件事。

四、第二件事:生成合成标识,管的是"每一条内容有没有说清楚自己是谁"

标识办法要解决的问题,官方负责人的话讲得很直白:"哪些是生成的""谁生成的""从哪里生成的"。

它管的是**"内容",而且是每一次生成的内容**。它不是申报制,是常态化义务——从你上线那天起,你生成的每一条文本、每一张图、每一段音频视频,只要属于需要标识的情形,就都得按规范带上标识。它没有"过审"这个终点,只有"持续合规"这个状态。

标识分两种:

  • 显式标识:让人一眼能看出来。文字提示、语音提示、节奏提示、图形角标,呈现在内容里或交互界面上,用户直接感知得到。
  • 隐式标识:人感知不到,但技术可读取。藏在文件元数据里(或鼓励采用的数字水印),记录这条内容是谁、在哪、什么时候生成的,用于事后溯源。

注意一个关键差异:备案是"服务提供者把服务报上去";标识是"服务提供者把每一次生成的结果标出来"。 一个对"服务",一个对"内容"。

五、最容易被忽视的一个字眼:"第十七条情形"

那是不是所有 AI 生成的内容都要打标?不是。触发显式标识义务的,是《深度合成管理规定》第十七条第一款列举的情形,标识办法第四条把它落成了具体操作要求。翻译成人话,大致覆盖这些服务:

  • 智能对话、智能写作——文本类(聊天机器人、文案生成都在此列)
  • 合成人声、仿声——音频类
  • 人脸生成、人脸替换、姿态操控——人物图像视频类
  • 沉浸式拟真场景
  • 配套国标进一步把文生图片、音乐创作、文生视频/图生视频等常见生成服务也列入典型场景

我们做的文案生成和智能客服,第一条就命中——文本类生成,必须加显式标识。而我当时的认知还停留在"材料里写一句我们会加标识",距离真正落地差了整整一套工程。

六、到底怎么标:国标 GB 45438-2025 的硬指标

配套标识办法,有一部强制性国家标准 GB 45438-2025《网络安全技术 人工智能生成合成内容标识方法》同日实施。强标意味着什么?意味着不是"建议你标得好看点",而是格式、位置、尺寸都有硬性规定,不达标就是违规。几个关键硬指标我摘出来:

显式标识(面向用户可感知的那层):

内容类型

标识形式

硬性要求

文本

文字或角标

文字需含"人工智能/AI"+"生成/合成"要素;可加在起始、末尾或中间;清晰可辨

图片

文字提示

边角位置;文字高度不低于画面最短边的 5%

音频

语音或节奏提示

语音提示按正常语速读出,或采用固定节奏(短长短短);加在首、尾或中间

视频

文字提示

起始画面必加;边角位置;高度不低于最短边 5%;正常播放下持续不少于 2 秒

交互界面

文字提示

内容附近,或界面顶部/底部/背景等位置持续显示

隐式标识(藏进文件的那层,元数据格式是强标附录 E 的规范性内容):

  • 在文件元数据里加含 AIGC 关键词的扩展字段,JSON 结构,至少六个要素:生成合成标签(Label)、生成合成服务提供者名称/编码、内容制作编号、内容传播服务提供者、内容传播编号、预留字段。
  • Label 取值是 1/2/3:1 = 属于 AI 生成,2 = 可能为 AI 生成,3 = 疑似为 AI 生成。
  • 一条规则很关键:一个生成文件里只保留一份元数据隐式标识,别自己反复叠加。
  • 数字水印属于鼓励采用的内容隐式标识,不是强制项,但做了对溯源更有利。

还有两条容易被漏掉的连带义务:

  1. 你提供下载、复制、导出功能时,导出的文件里必须带着满足要求的显式标识——不能让用户把你的 AI 图"另存为"之后标识就没了。
  2. 用户如果申请要"不带显式标识的版本",不是不能给,但你要在用户协议里明确他的标识义务,并把服务对象信息等日志留存至少 6 个月。

七、两件事的区别,一张表说清

维度

算法备案

生成合成内容标识

管的对象

算法服务("谁在提供服务")

生成内容("这条内容是不是 AI 的")

制度性质

申报制,一次过审拿号

常态化义务,上线后每天执行

触发时点

对外提供服务之前

每一次内容生成之时

审查重点

算法机制、安全评估、主体责任

显式/隐式标识的格式、位置、元数据

谁在查

备案系统审核(网信部门)

监管抽查 + 平台巡查 + 内容传播核验

通过标志

备案编号 + 官网公示

没有"通过"一说,只有持续合规

一句话记忆:备案决定你能不能上线,标识决定你上线的每一天会不会被追责。

八、但它们不是完全没交集——这才是关键

如果只是"两套独立制度",那分别办就是了。真正容易让人翻车的,是它们在材料层面有交叉:

《标识办法》第十二条明确写了:服务提供者在履行算法备案、安全评估等手续时,应当按照本办法提供生成合成内容标识相关材料。

翻译一下:你报备案的时候,审核方就会看你的标识方案。我们第四次被驳回的意见里就有一条——"未充分说明生成合成内容标识措施"。当时我理解为"在自评估报告里补一段话"。补完确实过审了。

但现在回头看,这个理解只对了一半。材料里写标识方案,是给备案审的;真正的标识工程,是给用户、给平台、给监管抽查看的。 备案通过那天,标识义务才真正开始计时。这两件事在材料上是一个入口,在执行上是两套完全不同的动作——这个"入口重合、执行分叉"的结构,才是混淆的根源。

九、2026 年的执法强度,已经不是"提醒"级别了

把时间拉回现在(本文成稿于 2026 年 9 月),标识办法实施已满一年。这一年的执法节奏,值得所有 AI 应用团队正视:

  • 2026 年 2 月:全国集中处置 13421 个无 AI 标识账号、清理相关信息 54.3 万余条。AI 生成虚假场景博流量、AI 换脸假冒公众人物、售卖去标识工具/教程(后者的性质比不标识更重——直接为破坏标识行为提供帮助)都在处置之列。
  • 2026 年 8 月(沈阳):AI 批量生成虚假新闻未标注、借汛情编造不实信息、用 AI 内容渲染焦虑卖课——分别被约谈注销、禁言、关停;一款能生成违规图文的应用被责令全链路整改(输入审核、生成审核、结果审核、人工复核、举报、日志留存全流程排查)。
  • 同期 AI 短剧赛道:未标注 AI 属性的短剧被成批清理,某平台单次专项一周下架超 3500 部。7 月起 AI 微短剧的标注规则进一步收紧。

值得注意的是处置对象的层次:不只是"发布者"被罚,平台也被要求承担核验义务(传播平台要核验元数据隐式标识、给疑似 AI 内容加提示)。也就是说,即使你只做技术提供方、内容是下游在传播,标识断链的责任同样可能回溯到你头上。

十、给 AI 应用团队的落地清单(抄作业版)

如果你正在做或准备做任何 AI 生成类产品,下面这几条建议在上线前就做进架构,别等上线后补:

  1. 把标识做进生成管线,而不是做在 UI 层。 文本在输出侧拼装提示语/角标,图片在渲染阶段打标,视频在合成流程里加起始帧标识——这些都是生成环节的事,不是前端展示层加个 div 的事。下载/导出链路的标识保留,必须在存储层就保证。
  2. 显式标识按强标硬指标自检。 图片文字高度是否达到最短边 5%、视频标识是否持续 2 秒以上、交互界面是否"持续显示"——这些是可以用脚本自动验证的,把它写进 CI。
  3. 隐式标识从第一天就写元数据。 用带 AIGC 扩展字段的规范 JSON,Label 按 1/2/3 语义取值,要素填全,别等平台核验你的时候才发现文件里什么都没有。
  4. 备案材料和标识方案保持同口径。 系统填报、自评估报告、拟公示内容里关于标识的描述,要和产品里真实实现的标识一致——这条和备案材料一致性的教训是一脉相承的(我们在别的字段上为此被驳回过不止一次)。
  5. 协议、日志、声明三件套提前备好。 用户协议里写明标识样式与管理要求;提供"去显式标识版本"的场景,日志留存 6 个月;给下游或传播平台的接口说明里,把元数据标识规范写清楚。
  6. 盯住平台细则。 微信、抖音、DeepSeek 等头部平台都已出台自己的 AI 标识管理细则,做内容分发的团队要跟着平台规则走,平台巡查是目前最一线的执法触手。

结尾

被驳回 4 次教会我的事,如果用一句话总结,就是:

算法备案是一张"入场券",它证明你被允许上场;而生成合成标识是每场比赛都要遵守的规则——备案不会替你挡掉任何一次违规生成。

那个备案号下发的下午,我确实松了口气。但现在我把它理解为:入场券到手,真正的日常合规才刚刚开始。

希望看到这篇文章的同行,都能比我们早一点想明白这件事。祝各位一次过审,也祝各位——上线之后,安稳运营。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一、备案号下来的那天,我以为这事就完了
  • 二、为什么会把两件事混成一件事
  • 三、第一件事:算法备案,管的是"你有没有在册"
  • 四、第二件事:生成合成标识,管的是"每一条内容有没有说清楚自己是谁"
  • 五、最容易被忽视的一个字眼:"第十七条情形"
  • 六、到底怎么标:国标 GB 45438-2025 的硬指标
  • 七、两件事的区别,一张表说清
  • 八、但它们不是完全没交集——这才是关键
  • 九、2026 年的执法强度,已经不是"提醒"级别了
  • 十、给 AI 应用团队的落地清单(抄作业版)
  • 结尾
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档