首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >算法备案全流程技术指南:从合规判定到拿到备案编号

算法备案全流程技术指南:从合规判定到拿到备案编号

原创
作者头像
AI算法大模型备案科普石榴
发布于 2026-09-09 16:37:13
发布于 2026-09-09 16:37:13
3620
举报
文章被收录于专栏:算法备案算法备案

先给一个总判断:算法备案的技术难度不高,但流程复杂度远超多数团队预期。 它由"判定、材料、填报、审核、持续合规"五个环节构成,其中真正耗费时间的不是写代码,而是把算法机制"讲成人话"、把安全措施"做出量化证据"、把三份材料"对上同一个口径"。

我们团队做了两个典型的文本生成功能——基于大语言模型的营销文案生成,以及基于大语言模型 + RAG 的园区智能客服。功能很常规,但从合规判定到拿到备案编号,中间经历多次驳回、多次补正。这篇文章把整套流程按技术实施顺序拆开,每一步对应做什么、容易在哪里翻车,一并写清楚。

全文结构如下:先做备案前判定,再理清"双备案"体系,然后按流程拆解六个阶段,最后给出时间规划与避坑清单。

一、备案前判定:你的算法到底要不要备案、备哪一类

很多团队拿到产品第一件事是写材料,这是顺序错误。第一步应该是判定。

  1. 触发条件

依据现行监管框架,需要履行算法备案义务的核心条件是"三有":在中国境内,面向公众提供信息服务,且服务具有舆论属性或社会动员能力。实践中,这一条大致看三点,命中其一通常就应当启动备案:

  • 存在个性化推荐类功能("猜你喜欢"式千人千面);
  • 存在 AI 生成内容能力(文本、图片、音频、视频、数字人等);
  • 存在信息发布与社区互动能力。

用第三方大模型 API 做上层应用的团队特别注意:调用已备案的模型,并不豁免你作为应用层服务提供者的备案义务,只是决定了你走"大模型备案"还是"大模型登记"通道(下文详述)。

  1. 算法类型判定

备案系统覆盖五类算法:生成合成类、个性化推送类、排序精选类、检索过滤类、调度决策类。系统选项里,深度合成已并入"生成合成类",统一显示为"生成合成类(深度合成)"。

判定只看算法的技术本质,不看业务话术。 这是最容易错的一步。比如"智能客服会推荐答案",业务上叫"推荐",但技术本质是根据用户问题生成新文本,属于生成合成类;把客服归到"个性化推送类",是典型的高频错判。我们的经验是:凡是"产出新内容"的都是生成合成,凡是"从既有内容里挑"的才谈得上推送、排序、检索。

  1. 角色判定:服务提供者还是技术支持者

同一套算法,两种角色对应不同的填报口径:

  • 服务提供者:直接面向终端用户提供服务,把算法能力打包进自己的产品;
  • 技术支持者:为他人提供服务所需的技术支持(如把模型能力以 API 形式输出给下游应用方)。

角色混填会导致备案范围与实际不符。自用 + 对外提供产品服务的团队,通常按服务提供者申报。注意:即使你作为技术支持者已经备案,你的下游客户只要直接面向公众,仍然需要以自己的主体做服务提供者备案——两边的义务不互相替代。

二、先理清监管体系:三个"备案/登记"不是一回事

在做任何动作之前,把下面这三件事分清楚,否则材料会互相"借用"、交叉出错:

  1. 算法备案:依据《互联网信息服务算法推荐管理规定》《互联网信息服务深度合成管理规定》。覆盖五类算法,全程在互联网信息服务算法备案系统(beian.cac.gov.cn)线上办理。管的是"算法服务有没有在册"。
  2. 大模型备案(上线备案):依据《生成式人工智能服务管理暂行办法》。适用于自研底座模型、做了深度微调(改动权重)的生成式 AI 服务。线下向属地省级网信部门提交,省级初审后再由中央网信部门评审测试。材料包括《生成式人工智能(大语言模型)上线备案表》、安全评估报告、模型服务协议、语料标注规则、拦截关键词列表、评估测试题集等,审核包含技术测试。
  3. 大模型登记:仅调用第三方已备案大模型 API、做应用层封装的生成式 AI 功能,走登记制,属地省级网信部门审核即可,材料轻量(登记表 + 模型服务协议),周期明显短于备案。

关键结论:对文本生成类 SaaS 服务,"算法备案"是必做项;"大模型备案还是登记"取决于你的底座是自研/微调,还是纯调 API。 两者不是二选一,是并行义务。算法备案和大模型备案的区别可以一句话概括:算法备案是给"这条算法服务"做注册,大模型备案是给"面向公众的生成能力"做准入审查,含金量和周期都更高。

三、流程拆解:六个阶段,从资质到拿号

阶段 0:前置资质自查(最容易被低估的一步)

正式填报前,先确认四件事,否则会在主体审核阶段被卡住:

  • 营业执照经营范围:应覆盖软件开发、互联网信息服务乃至人工智能相关服务。没有对应经营范围,先做变更再启动,否则提交即退。
  • ICP 备案:承载算法的网站、App、小程序须先完成 ICP 备案。备案系统里填写的产品名称、域名必须与 ICP 备案信息一一对应。
  • 算法安全责任人:必须是本公司全职员工。兼职、外包、顾问一律不行。任职材料须按系统模板格式填写岗位职责,并附工作证明/社保证明佐证。
  • 制度文件:《算法安全管理制度》《应急预案》《落实算法安全主体责任基本情况》等制度类文件不能套用网上下载的模板。审核方会查重并核对是否与公司实际组织架构、业务流程一致,模板痕迹明显是常见退件原因。

阶段 1:主体注册与审核

登录互联网信息服务算法备案系统(beian.cac.gov.cn),注册账号并完成主体实名认证(法人扫码或电子营业执照),然后填报主体信息:企业基本信息、证件信息、法定代表人信息、算法安全责任人信息,并上传《算法备案承诺书》(官方模板,法定代表人签字盖章)和《落实算法安全主体责任基本情况》。

省级网信办完成主体审核通常需要数个工作日。注意:必须先通过主体审核,才能进入算法信息填报,所以阶段 0 的资质问题越早解决越好。

阶段 2:算法信息登记

一条算法一条记录,多个算法必须分别填报,不能"一把梭"。每个算法需填写两大部分:

基础属性:算法类型(本例为"生成合成类(深度合成)")、角色(服务提供者/技术支持者)、算法名称、应用领域、上线时间。

算法名称是重要的合规标识,建议采用"品牌名 + 功能/场景 + 算法"的格式,例如"XX 营销文案生成算法""XX 园区智能客服对话算法"。名称一旦确定,此后所有材料必须沿用同一个,绝不能在中途更换表述。

详细属性:算法数据、算法模型、算法策略、算法风险与防范机制。这一部分建议配合安全自评估报告一起准备,填报内容与报告内容保持完全一致。系统支持随时"保存至草稿箱",建议边整理材料边填,避免信息丢失。

阶段 3:核心材料撰写(全流程的耗时大头)

技术向团队最容易在这部分出问题——不是写不出来,是用技术语言写合规材料和用合规语言讲技术逻辑之间的转换出了问题。四份材料的技术要点如下。

材料一:机制机理说明——按"输入 → 处理 → 输出 → 风险处置"四层写

审核方要看懂算法逻辑,而不是欣赏名词库。推荐四层框架:输入层、模型层、逻辑层、输出层,每一步都把安全节点写进去。以我们的营销文案生成算法为例,这段表述后来直接用于公示材料:

算法作用对象为文本数据。根据用户输入的文案主题、风格要求和园区资料信息,利用大语言模型技术对输入内容进行语义理解,结合园区资料库中的楼宇参数、招商政策等结构化信息,生成符合用户需求的园区营销文案,包括招商介绍、活动宣传、政策通知等多类型文本。 运行机制:

  1. 用户输入需要生成文案的文本信息(主题、风格、篇幅等);
  2. 输入内容经内容安全审核,命中违规内容触发安全监测,不通过则不生成;
  3. 通过审核的输入进入文案生成模块,理解用户需求并结合园区资料库生成文案草稿;
  4. 草稿再次经内容安全审核,并对涉及租金、面积、政策等关键信息进行事实核查;
  5. 输出最终结果,记录操作日志。

加分项有三个:每步体现安全节点(输入审、输出审、事实核查);写明可干预、可熔断机制(审核不通过即终止);写明输出内容的 AI 标识方案。RAG 场景(如我们的智能客服)还要突出"答复与知识库一致性校验",防止模型编造知识库之外的政策信息。

材料二:算法安全自评估报告——只认"量化 + 落地"

自评估报告是整套材料中审核最严、驳回率最高的部分。两个写作纪律:

一是风险研判必须结合自身业务,不能抄通用风险清单。要写"我们这个场景可能产生什么风险、影响谁、怎么防"。例如智能客服场景的真实风险是"把知识库之外的信息编造成园区政策",对应措施就是"答复与知识库一致性校验 + 兜底话术"。

二是防控措施必须有数字。把"内容审核机制健全"改成"输入与输出双环节内容安全审核,高风险内容 100% 人工复核,敏感词库定期更新并留存版本记录,操作日志留存不少于 6 个月"。审核只认能量化的、能追溯的东西。

材料三:拟公示机制机理内容——用公众能懂的语言浓缩

公示内容是给社会公众看的,200 字以内要讲清"这是什么算法、干什么用、怎么保证安全"。要点:避免堆砌技术术语,避免涉密细节,同时必须与线上产品真实展示的内容一致——监管巡查会做比对。可以参考的写法是:一句话讲用途、一句话讲技术路线、一句话讲安全措施、一句话讲边界(如"仅用于园区营销文案场景,不涉及人脸等生物特征信息处理")。

材料四:生成合成内容标识方案——别只写承诺,要给实现

依据《人工智能生成合成内容标识办法》及配套强制性国家标准(GB 45438-2025),文本生成类服务属于需要显式标识的典型场景。材料层面要写清楚你的标识实现方式,例如:生成内容在文首/文末附加含"人工智能生成"要素的文字提示,不可关闭;文件元数据中写入符合规范的隐式标识(含 AIGC 扩展字段);下载、导出链路中的标识随文件保留。注意:材料里写标识方案,是给备案审核看的;真正让标识每天生效的,是生成管线里的工程实现。 两者要一致,缺一不可。

阶段 4:关联产品及功能

服务提供者需要勾选应用该算法的产品及功能,注意三种粒度:勾选产品 = 该产品下所有功能;勾选功能访问路径 = 该路径下所有功能;勾选特定功能 = 仅该功能。粒度选错会导致备案范围与实际不符。例如算法只用于某个小程序的特定入口,就不要一路勾到整个产品。

阶段 5:提交、审核与公示

提交前,务必做一遍"一致性对账"——这是退件的头号原因。系统填报、安全自评估报告、拟公示内容三份材料的算法名称、功能模态、应用场景、数据来源、量化指标、企业信息必须完全一致,统一社会信用代码连字符格式都不能错。

审核大致经历四步:

  1. 初审:省级网信办核查材料完整性、形式合规性,通常需要数个工作日到十余个工作日,线上化程度高的地区更快;
  2. 复审:国家网信办组织技术合规审查,周期通常 1-2 个月,生成式 AI 等复杂算法可能更长,可能引入第三方技术测试;
  3. 补正:材料有问题需修改,每次补正后重新排队,额外增加数周周期。这就是为什么低水平驳回代价极高;
  4. 公示:审核通过后进入公示,无异议后发放备案编号("网信算备"字号)。

拿到编号后,必须将备案编号和公示链接展示在产品显著位置(如网站底部、用户协议中),与线上实际产品保持一致。

四、大模型备案/登记的并行推进策略

如果你的服务触发了大模型备案义务,它与算法备案是两条并行的线,时间上要提前规划,因为大模型备案通常需要更长周期(材料审核 + 技术测试)。

技术团队最容易忽略的是评估测试题库建设。安全评估报告需要测试题库支撑,实践中对生成测试题量、拒答专项题量、风险关键词库规模、敏感问题拒答率等都有量化口径要求,且需要附模型的实际输出记录。题库建设是最耗时的环节,建议在开发阶段就同步积累,而不是等材料阶段临时凑。

几个并行推进的实务要点:

  • 调用第三方大模型提供服务时,材料准备需要模型提供方配合(如提供模型备案情况),建议在商务协议中提前约定对方对备案手续的协助义务;
  • 用户实名注册机制、服务协议中与 AI 相关的条款(含标识要求、免责声明),要在备案阶段同步到位,不要等拿号后再补;
  • 属地口径优先:大模型备案的具体材料要求由各地网信部门掌握,省份间存在差异,启动前先与属地网信部门沟通,比照搬网络模板可靠得多;
  • 自研、二次开发与纯 API 调用的材料要求和审核层级不同,先明确自己的底座形态再决定走哪条线。

五、备案后的持续技术义务

拿到编号不是终点。以下几项是拿到备案编号后仍然持续的硬性义务:

  1. 公示与一致性维护:备案号在产品显著位置、用户协议中展示,并保持与线上实际产品一致,监管巡查会做比对;
  2. 年度自评估:每年提交上一年度的算法安全自评估报告,需留存日常审核、复核记录作为佐证;
  3. 变更备案:算法原理、数据类型、输出形式、产品形态等发生重大变化,须在法定期限内(实操建议 10 个工作日内)提交变更申请;
  4. 注销备案:服务停止或算法下线,及时办理注销,避免被列入异常名单;
  5. 抽查机制:监管部门会对已备案算法开展常态化抽查,安全评估、内容审核、用户权益保障都需要持续合规,抽查不合格同样会被处置。同时,生成合成标识义务从上线第一天起持续生效,每次生成的内容都要合规打标,这是一项没有终点的日常工程。

六、时间规划建议

综合上述流程,给计划启动备案的团队一个可执行的时间盒:

  • 合规判定与类目梳理:约 2 周,判断备几个、走哪条通道,同时启动前置资质排查(营业执照、ICP 最优先);
  • 材料撰写:1-2 个月,机制机理 + 自评估报告 + 制度文件同步推进,算法同学写初稿、合规同学统一口径;
  • 题库与安全测试数据积累:越早越好,与大模型备案材料撰写并行,这是最容易拖长周期的隐性环节;
  • 提交到拿号:按初审 + 复审 + 公示的整体节奏,为一次通过预留 3-6 个月,并把每次补正重排队的成本算进去。

两个时间管理上的血泪教训:一是内测即上线,只要面向真实用户提供服务就视为上线,不要赌"先上了再说";二是材料撰写放在关键路径上,别等所有前置资质齐了才动笔。

七、高频退件点与避坑清单

最后,把我们在实操中遇到及同行高频踩中的退件点汇总如下,提交前逐条对照:

  • 类目判定错误:把生成合成类误判为其他类型,用业务话术代替技术本质判断;
  • 多算法一把梭:一个产品有多个生成能力,必须分别填报、各建一条算法记录;
  • 算法名称随意或前后不一致:名称要符合"品牌 + 功能 + 算法"规范,且所有材料统一;
  • 材料口径打架:系统填报、自评估报告、拟公示内容三个口径不一致,这是最普遍也最低级的退件原因;
  • 主体资质不齐:营业执照经营范围缺失、ICP 未备案、算法安全责任人非全职员工;
  • 机制机理"假大空":堆砌架构名词,却讲不清"输入什么 → 怎么处理 → 输出什么 → 出问题怎么办";
  • 自评估报告无量化、纯表态:没有数字、没有落地机制、模板痕迹明显;
  • 语料合规链断裂:训练语料只写"来源合法",没有来源清单、授权协议、清洗脱敏与个人信息处理说明;
  • AI 标识没落地:材料里写了标识方案,产品里没有在每个可见输出位置实现不可关闭的显式标识;
  • 缺实证材料:只有文字描述,没有关键词库样本、审核后台截图、模型输出记录等可佐证的东西。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一、备案前判定:你的算法到底要不要备案、备哪一类
  • 二、先理清监管体系:三个"备案/登记"不是一回事
  • 三、流程拆解:六个阶段,从资质到拿号
    • 阶段 0:前置资质自查(最容易被低估的一步)
    • 阶段 1:主体注册与审核
    • 阶段 2:算法信息登记
    • 阶段 3:核心材料撰写(全流程的耗时大头)
      • 材料一:机制机理说明——按"输入 → 处理 → 输出 → 风险处置"四层写
      • 材料二:算法安全自评估报告——只认"量化 + 落地"
      • 材料三:拟公示机制机理内容——用公众能懂的语言浓缩
      • 材料四:生成合成内容标识方案——别只写承诺,要给实现
    • 阶段 4:关联产品及功能
    • 阶段 5:提交、审核与公示
  • 四、大模型备案/登记的并行推进策略
  • 五、备案后的持续技术义务
  • 六、时间规划建议
  • 七、高频退件点与避坑清单
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档