一家已通过 DCMM 三级评估的企业 CDO,在准备冲刺 L4 时发现,新版标准的评估指标里新增了一类条目——"是否具备人工智能辅助数据管理能力"。这不是锦上添花,而是 L4 量化管理级评估的重要组成部分。
要理解这一变化的逻辑,需要先看清 DCMM 2.0 相对于 1.0 版的三项关键升级。
第一,能力域从 8 个扩展为 9 个。新增「数据资产」能力域(权属管理、价值评估、资产运营),将数据资产化从行业实践上升为国家标准框架。「数据应用」更名为「数据应用流通」,新增外部数据管理能力项,覆盖了数据从内部使用到外部流通的全链路。
第二,评估指标体系从定性描述升级为 486 项量化指标。DCMM 1.0 的 441 项指标侧重"有没有",DCMM 2.0 的 486 项指标进一步追问"运行得怎么样"——不仅要求具备书面制度和执行记录,更需要可量化的管理数据作为证据。
第三,L4 量化管理级引入人工智能等先进技术。这是 DCMM 标准历史上首次将技术能力写入成熟度等级。标准对 L4 的定义是"组织将数据视为获取竞争优势的核心要素,通过量化管理驱动管理效能提升;引入人工智能等先进技术,全面提升数据管理工作效率"。同时,安全域的要求也较 1.0 显著增强,能力项从策略/管理/审计升级为合规管理/安全防护/安全审计。
DCMM 2.0 将数据管理成熟度划分为五个等级:初始级(L1)、受管理级(L2)、稳健级(L3)、量化管理级(L4)和优化级(L5)。L4 级首次引入人工智能等先进技术要求,标志着数据管理成熟度评估正式进入量化管理和 AI 驱动的阶段。
DCMM 2.0 的五级成熟度模型中,L3(稳健级)与 L4(量化管理级)之间存在一个质的跃迁。L3 的核心是"有"——建立了统一的数据管理体系,各项流程在组织层面运转。L4 的核心是"量化"——建立了量化的指标体系来度量管理效能。
典型的 L4 级量化指标包括:数据问题平均修复时长不超过 2 小时、关键数据标准覆盖率达到 95% 以上、数据质量问题的自动发现率等。这些指标的确立,意味着企业的数据管理从"靠人评估"走向"靠数据说话"。
AI 在这一跃迁中扮演的角色是效率杠杆。486 项量化指标的追踪、数据质量问题的自动发现和推荐修复、元数据的自动采集和血缘分析——这些工作如果全部依赖人工,在达到 L4 所要求的数据规模和管理精细度时将难以为继。标准在 L4 引入人工智能等先进技术,本质上是对规模化数据管理效率的必然要求。
截至 2025 年 11 月,全国 DCMM 贯标企业总数已达 10,448 家,其中 DCMM 5 级(最高等级)仅 33 家。DCMM 2.0 于 2025 年 12 月 31 日发布,2026 年 7 月 1 日正式实施。对已获 L3 等级的企业而言,在准备 L4 升级评估时需要将 AI 能力纳入建设规划;对于仍在 L2 阶段的企业,较为稳妥的做法是在治理底座建设阶段就为 AI 能力预留接口。
DCMM 2.0 在 L4 引入人工智能等先进技术,对应到数据治理实践中,主要体现在四个核心场景。这些场景并非理论推演,而是已有明确技术路径和落地案例。

数据质量问题的传导链路清晰而直接:原始数据的缺失、错误、重复等问题进入模型后,模型全盘接受并作为推理基础,分析结果出现偏差,最终误导业务决策。这条链路说明数据质量是 AI 输出可信度的前置条件,不解决源头的质量问题,AI 的能力边界就由数据缺陷决定。
传统的数据分类分级依赖人工翻阅字段列表逐一标注,当数据量达到数百张表、数千个字段时,维护成本呈指数级增长。AI 的介入方式是将分类分级从"人工标注"转变为"智能识别"——系统自动识别敏感字段(身份证号、手机号、金额字段等),根据字段内容和上下文推断数据等级,建立可动态更新的分类标签体系。
该场景对应 DCMM 2.0 数据安全域(合规管理、安全防护)和数据标准域的能力要求。在 L4 评估中,数据的分类分级覆盖率是安全域的重要量化指标,AI 的自动化能力是实现高覆盖率的基础保障。
数据质量规则的配置在传统模式下高度依赖个人经验——有经验的工程师知道"金额字段要检查非负,日期字段要检查格式",新人则不知道从何入手。AI 的做法是基于字段特征(字段名、数据类型、值域分布)和历史规则库,自动推荐适用的质量校验规则,将规则配置效率提升 10 倍以上。
该场景直接对应 DCMM 2.0 数据质量域(数据质量检查、数据质量分析)。L4 要求的 486 项量化指标中,质量域占比显著,自动化规则推荐是实现质量指标追踪的技术前提。
传统的数据查询链路是"业务人员提需求 → IT 排期写 SQL → 返回结果",整个周期短则数小时、长则数天。自然语言查询将这条链路缩短为"业务人员用日常语言提问 → 系统自动理解意图、生成 SQL → 返回结果和可视化图表",将数据查询的门槛从"会写 SQL"降低到"会问问题"。
该场景对应 DCMM 2.0 数据应用流通域(数据应用、数据服务)。目前市场上已有部分产品提供开箱即用的 NL2SQL 能力,简单查询场景准确率可达 100%,全场景综合准确率超过 95%,数据不出域,支持 DeepSeek 和千问 3 等主流大模型的智能调度。
固定阈值的告警方式长期以来面临"误报多、漏报多"的困境——阈值设高了漏过真实异常,设低了被大量误报淹没。AI 通过学习历史数据的趋势和波动模式,能够区分"正常的业务波动"和"需要关注的异常信号",显著降低误报率,同时提升真实异常的检出率。
该场景横跨 DCMM 2.0 的数据质量域和数据生存周期域(数据运维),是在 L4 量化管理框架下实现数据运维效率提升的关键技术路径。
四大场景的技术路径已经清晰,但企业从 L3 走向 L4 的过程中,面临的挑战主要不在技术层面,而在数据基础、组织协同和制度配套。
大语言模型的一个重要特征是,它对输入数据具有天然的"信任"倾向——模型不会主动质疑数据来源的可靠性,而是将输入数据作为推理的事实基础。当数据存在缺失值、错误记录或重复数据时,这些缺陷会被模型全盘接受并反映在最终输出中。
一个经典案例来自制造业:某企业的 ERP 系统中"华东区销售额"在同一月份存在两条记录——一条记录 3,200 万元(含退货冲销前的原始订单),一条记录 2,800 万元(财务核算后的实际确认),两条记录都标注为"最终版本"。AI 在进行区域销售分析时无法判断哪一个数值是正确的,最终输出的分析报告将两个数值进行了简单平均,导致结论与实际情况偏差超过 7%。
这正是 Data-Centric AI 理念所强调的核心观点:AI 效果的上限,是由数据质量决定的,而不是由模型参数决定的。在模型能力趋于同质化的当下,数据质量的差异正在成为企业 AI 能力差异的决定性因素。
即使数据本身的质量合格,如果 AI 无法理解数据的业务含义,其输出价值依然有限。问题的根源在于,大多数企业的元数据管理停留在技术层面——表结构、字段类型、长度约束记录得很清楚,但字段的业务语义几乎空白。
例如,一个字段的元数据描述是"VARCHAR(50),不可为空",但字段名是 amount。在 ERP 系统中它代表含税订单金额,在财务系统中它代表不含税实际收入,在 CRM 系统中它代表预估合同金额。AI 无法从技术元数据中区分这三个 amount 的业务差异,跨表关联分析时就会出现口径混乱。
DCMM 2.0 的数据标准域(业务术语、数据元、指标数据)正是解决这一问题的框架——当企业建立了统一的业务术语标准和数据元标准后,AI 就能准确理解"这个 amount 在财务语境下是不含税金额",从而在跨表分析时做出正确的语义对齐。
在不少已经建立数据治理体系的企业中,存在一个结构性矛盾:治理团队的产出和 AI 团队的需求之间存在断层。
治理团队的工作成果——数据标准文档、质量评估报告、资产目录——以"汇报材料"的形式存在,AI 团队看不到也用不上。AI 团队从数据湖直接拉取原始数据,治理团队不知道他们在用什么数据、数据质量是否满足 AI 需求。"管"和"用"是两条平行线,各走各的路。
DCMM 2.0 将数据治理组织、制度建设和数据文化建设列为核心能力域,意味着标准本身就预设了一个前提:数据治理首先是组织治理。L4 的 AI 要求不是一个纯技术问题——如果治理团队和 AI 团队继续各行其是,AI 辅助数据管理就缺乏组织层面的运行基础。
DCMM 2.0 将安全域的能力项从策略/管理/审计升级为合规管理/安全防护/安全审计,合规要求的显著增强并非偶然。
在传统 BI 环境中,数据权限控制可以精确到字段级——某个用户能看到哪些表、哪些字段、甚至能执行什么类型的查询,都可以通过权限体系精细管理。但在大模型的自然语言交互场景下,权限和输出的边界变得难以精细控制:用户的一个"帮我看看各区域的销售情况"可能在执行过程中访问了超出其权限范围的数据,模型在生成回答时也可能无意中暴露了敏感信息。
这也解释了为什么 DCMM 2.0 强调数据的分类分级和脱敏处理——数据在进入 AI 系统之前,建议先完成安全域的基础建设,否则 AI 的便利性与数据的安全性之间会形成一个难以调和的对立。
应对四大挑战的路径,可以归纳为三个阶段。每个阶段对应 DCMM 2.0 的不同能力域,各阶段之间既有先后关系,也有重叠推进的空间。

需要明确一个基本前提:DCMM 2.0 是评估的"检查清单",理采存管用方法论是工程落地的"施工图纸"。标准告诉企业"应该具备什么能力",方法论告诉企业"怎么一步步把这些能力建起来"。两者之间的关系,从多数成功案例来看,通常是标准定目标、方法论定路径、产品定落地。
在评估实践中,方法论驱动的数据治理框架通常将 DCMM 2.0 九大能力域映射到五个工程阶段:理(数据战略、数据架构)→ 采(数据应用流通)→ 存(数据生存周期)→ 管(数据标准、数据质量、数据安全)→ 用(数据资产)。这一映射关系可以作为选型和评估的参考框架,帮助企业在 DCMM 评估要求与日常工程实践之间建立清晰的对应关系。
这一阶段的核心目标是让 AI"有数据可用、能读得懂数据"。具体包括四项基础工作:
amount 代表"预估合同金额",DW 中的 amount 代表"不含税实际收入"。这一步是 AI 理解数据的前置条件。这一阶段对应 DCMM 2.0 的数据架构、数据标准、数据质量三个能力域。以江西某国控集团为例,该企业 10 余套业务系统分散独立运行,监管数据质量缺乏管控。通过构建覆盖完整性、准确性、一致性、及时性、唯一性五个维度的稽核规则体系,半年内将核心数据质量问题的修复周期从两周缩短至两天。
底座夯实之后,将 AI 能力逐步嵌入数据治理的日常工作流。这个阶段的策略不是"全面铺开",而是选一个与业务痛点直接关联的场景先跑通:
这一阶段对应 DCMM 2.0 的数据安全、数据应用流通两个能力域。关键成功因素不是技术选型,而是组织层面的"管用一体"——AI 能力嵌入之后,治理团队的产出(标准、目录、质量基线)直接变成 AI 团队的输入(语义模型、查询接口、可信数据源),打破"管用分离"的结构性断层。
当 AI 能力在局部场景验证有效后,下一步是建立量化追踪和持续优化机制,真正实现 L4 所要求的"数据驱动管理":
江苏某国企数科的案例提供了一个参考样本。该企业承接 M 市数据要素流通平台的建设运营,汇聚了大量公共数据和市场化数据资源,面临"找数难、用数难、运营难"三大瓶颈。通过部署"感知-匹配-演进"三位一体 AI 智能体,分三阶段推进——知识体系与智能能力建设、应用集成与场景落地、运营闭环与持续优化——实现了基础咨询工单量显著下降、检索耗时大幅缩短、数据产品复用率明显提升。如客户所评价:"以前推数据产品像蒙着眼睛打靶,智能体给了我们一杆瞄准镜。"
这一阶段对应 DCMM 2.0 的数据资产、数据战略两个能力域。需要指出的是,数据治理的终点不是系统上线,而是组织真正具备持续用好数据的能力。"产品+培训+陪跑"的组合模式是行业实践中验证有效的路径——培训解决"知道怎么做",陪跑解决"能自己做",最终目标是客户团队独立运转,而非依赖外部厂商。
DCMM 2.0 在 L4 量化管理级引入人工智能等先进技术,不应被解读为标准对企业的"增设门槛"。它的实质是将一个已在行业实践中反复验证的共识——数据治理的成熟度决定 AI 能力的天花板——通过国家标准的形式制度化。
从 Data-Centric AI 的理念验证,到大模型落地过程中反复撞上数据治理的墙,再到 DCMM 2.0 将 AI 能力写入评估框架,这三者指向同一个方向:数据治理正在从"IT 部门的后台工作"演变为"AI 战略的基础设施"。企业如果不能回答"数据在哪里、质量怎么样、标准是否统一"这三个问题,AI 建设就始终缺乏地基。
对企业的实用建议可以归纳为三点。其一,"先理后 AI"——AI 能力在治理流程中的嵌入,应当建立在数据目录、元数据语义、标准口径和质量基线初步完备的基础之上。其二,"治理即 AI 基础设施"——元数据是 AI 理解数据的"翻译层",数据标准是跨表关联的"统一语义层",数据质量是 AI 输出可信度的"基准线",这三层不是治理的副产品,而是 AI 的底层依赖。其三,"管用一体"——打破治理团队和 AI 团队的组织壁垒,让治理产出直接服务于 AI 应用。
DCMM 2.0 的实施只是一个起点。随着数据资产入表(财会〔2023〕11 号)、"数据要素×"三年行动计划的推进,数据治理成熟度正在从"贯标评估的一个分数"变成企业数据能力的"硬通货"。对于志在 L4 及以上的企业,AI 不是数据治理做完之后的锦上添花,而是数据治理能力本身的组成部分。
Q1:DCMM 2.0 在 L4 引入人工智能等先进技术,是否意味着企业必须自研 AI?
不是。DCMM 2.0 评估的是"是否具备人工智能辅助数据管理能力",而不是"AI 是不是自研的"。企业可以通过引入成熟的 AI 数据治理产品和工具来满足这一要求,关键在于能力的存在和运行,而非能力的来源。
Q2:企业目前还在 L2 或 L3,有必要现在关注 AI 吗?
有必要。L2→L3 通常需要 12-24 个月,L3→L4 同样需要 12-18 个月。如果等到冲刺 L4 时才开始考虑 AI 能力建设,时间窗口将非常紧张。较为稳妥的做法是在治理底座建设阶段就为 AI 能力预留接口——例如在搭建资产目录时就考虑 AI 的可访问性,在配置质量规则时就引入 AI 推荐机制。具体路径已在第四节详述。
Q3:AI 和数据治理到底谁先谁后?
不完全是先后关系。DCMM 2.0 传递的信号是,AI 不是治理做完之后的"锦上添花",而是治理能力发展到 L4 阶段的"内在要求"。但在实操层面,较为务实的做法是选一个高价值场景(如 NL2SQL 或质量规则推荐),先把该场景涉及的核心数据域的元数据和标准做扎实,跑通 AI 用数闭环,再横向扩展到其他场景。不是"等治理完美了再上 AI",也不是"跳过治理直接上 AI",而是"边治理边验证,以用促治"。
Q4:中小企业没有专门的 AI 团队,怎么满足 L4 的 AI 要求?
中小企业反而可能是 AI 在数据治理领域落地更容易的场景——团队规模小、数据量相对可控、没有"管用分离"的组织割裂。目前市场上已有部分产品提供开箱即用的自然语言用数能力,集成 DeepSeek 和千问 3 等主流大模型,数据不出域。中小企业的主要工作不是组建 AI 团队,而是把核心数据域的治理底子打好——确保元数据说清楚业务含义、数据标准统一核心口径、核心表的数据质量达到可用水平。在此基础上,AI 用数能力的部署和运行并不需要庞大的技术团队。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。