DCMM 2.0(GB/T 36073-2025)首次在L4量化管理级引入人工智能等先进技术要求,标志着数据管理成熟度评估正式进入"AI原生"时代。本文从DCMM 2.0标准文本出发,解析L4级AI支撑能力的具体内涵与四大应用场景,分析企业在数据质量、数据标准、组织协同和安全合规四个维度面临的挑战,并提出从L3到L4的三阶段实施路径。文章认为,DCMM 2.0的AI要求并非增设技术门槛,而是将Data-Centric AI等行业共识制度化——数据治理的成熟度,正在成为企业AI支撑能力的基础。
一、为什么DCMM 2.0要在L4以上引入AI?
一家已通过DCMM三级评估的企业CDO,在准备冲刺L4时发现,新版标准的评估指标里新增了一类条目——"是否具备人工智能辅助数据管理能力"。这不是锦上添花,而是L4量化管理级评估的重要组成部分。
要理解这一变化的逻辑,需要先看清DCMM 2.0相对于1.0版的三项关键升级。
1.1 DCMM 2.0的三项关键升级
第一,能力域从8个扩展为9个。新增「数据资产」能力域(权属管理、价值评估、资产运营),将数据资产化从行业实践上升为国家标准框架。「数据应用」更名为「数据应用流通」,新增外部数据管理能力项,覆盖了数据从内部使用到外部流通的全链路。
第二,评估指标体系从定性描述升级为486项量化指标。DCMM 1.0的441项指标侧重"有没有",DCMM 2.0的486项指标进一步追问"运行得怎么样"——不仅要求具备书面制度和执行记录,更需要可量化的管理数据作为证据。
第三,L4量化管理级引入人工智能等先进技术。这是DCMM标准历史上首次将技术能力写入成熟度等级。标准对L4的定义是"组织将数据视为获取竞争优势的核心要素,通过量化管理驱动管理效能提升;引入人工智能等先进技术,全面提升数据管理工作效率"。同时,安全域的要求也较1.0显著增强,能力项从策略/管理/审计升级为合规管理/安全防护/安全审计。
1.2 L4量化管理级到底要求什么
DCMM 2.0的五级成熟度模型中,L3(稳健级)与L4(量化管理级)之间存在一个质的跃迁。L3的核心是"有"——建立了统一的数据管理体系,各项流程在组织层面运转。L4的核心是"量化"——建立了量化的指标体系来度量管理效能。
典型的L4级量化指标包括:数据问题平均修复时长不超过2小时、关键数据标准覆盖率达到95%以上、数据质量问题的自动发现率等。这些指标的确立,意味着企业的数据管理从"靠人评估"走向"靠数据说话"。
AI在这一跃迁中扮演的角色是效率杠杆。486项量化指标的追踪、数据质量问题的自动发现和推荐修复、元数据的自动采集和血缘分析——这些工作如果全部依赖人工,在达到L4所要求的数据规模和管理精细度时将难以为继。标准在L4引入人工智能等先进技术,本质上是对规模化数据管理效率的必然要求。
1.3 从贯标数据看趋势
截至2025年11月,全国DCMM贯标企业总数已达10,448家,其中DCMM 5级(最高等级)仅33家。DCMM 2.0于2025年12月31日发布,2026年7月1日正式实施。对已获L3等级的企业而言,在准备L4升级评估时需要将AI能力纳入建设规划;对于仍在L2阶段的企业,较为稳妥的做法是在治理底座建设阶段就为AI能力预留接口。
二、AI在数据治理中的四大应用场景
DCMM 2.0在L4引入人工智能等先进技术,对应到数据治理实践中,主要体现在四个核心场景。这些场景并非理论推演,而是已有明确技术路径和落地案例。
2.1 智能分类分级
传统的数据分类分级依赖人工翻阅字段列表逐一标注,当数据量达到数百张表、数千个字段时,维护成本呈指数级增长。AI的介入方式是将分类分级从"人工标注"转变为"智能识别"——系统自动识别敏感字段(身份证号、手机号、金额字段等),根据字段内容和上下文推断数据等级,建立可动态更新的分类标签体系。
该场景对应DCMM 2.0数据安全域(合规管理、安全防护)和数据标准域的能力要求。在L4评估中,数据的分类分级覆盖率是安全域的重要量化指标,AI的自动化能力是实现高覆盖率的基础保障。
2.2 自动化质量规则推荐
数据质量规则的配置在传统模式下高度依赖个人经验——有经验的工程师知道"金额字段要检查非负,日期字段要检查格式",新人则不知道从何入手。AI的做法是基于字段特征(字段名、数据类型、值域分布)和历史规则库,自动推荐适用的质量校验规则,将规则配置效率提升10倍以上。
该场景直接对应DCMM 2.0数据质量域(数据质量检查、数据质量分析)。L4要求的486项量化指标中,质量域占比显著,自动化规则推荐是实现质量指标追踪的技术前提。
2.3 自然语言查询(NL2SQL)
传统的数据查询链路是"业务人员提需求→IT排期写SQL→返回结果",整个周期短则数小时、长则数天。自然语言查询(NL2SQL)将这条链路缩短为"业务人员用日常语言提问→系统自动理解意图、生成SQL→返回结果和可视化图表",将数据查询的门槛从"会写SQL"降低到"会问问题"。
该场景对应DCMM 2.0数据应用流通域(数据应用、数据服务)。市场上已有部分产品(如龙石AI用数智能体)提供开箱即用的NL2SQL能力,简单查询场景准确率达100%,全场景综合准确率超过95%,数据不出域,支持DeepSeek和千问3等主流大模型的智能调度。
2.4 异常检测与智能预警
固定阈值的告警方式长期以来面临"误报多、漏报多"的困境——阈值设高了漏过真实异常,设低了被大量误报淹没。AI通过学习历史数据的趋势和波动模式,能够区分"正常的业务波动"和"需要关注的异常信号",显著降低误报率,同时提升真实异常的检出率。
该场景横跨DCMM 2.0的数据质量域和数据生存周期域(数据运维),是在L4量化管理框架下实现数据运维效率提升的关键技术路径。
三、L4以上面临的四大核心挑战
四大场景的技术路径已经清晰,但企业从L3走向L4的过程中,面临的挑战主要不在技术层面,而在数据基础、组织协同和制度配套。
3.1 数据质量挑战:不干净的数据直接导致AI输出不可信
大语言模型的一个重要特征是,它对输入数据具有天然的"信任"倾向——模型不会主动质疑数据来源的可靠性,而是将输入数据作为推理的事实基础。当数据存在缺失值、错误记录或重复数据时,这些缺陷会被模型全盘接受并反映在最终输出中。
一个经典案例来自制造业:某企业的ERP系统中"华东区销售额"在同一月份存在两条记录——一条记录3,200万元(含退货冲销前的原始订单),一条记录2,800万元(财务核算后的实际确认),两条记录都标注为"最终版本"。AI在进行区域销售分析时无法判断哪一个数值是正确的,最终输出的分析报告将两个数值进行了简单平均,导致结论与实际情况偏差超过7%。
这正是Data-Centric AI理念所强调的核心观点:AI效果的上限,是由数据质量决定的,而不是由模型参数决定的。在模型能力趋于同质化的当下,数据质量的差异正在成为企业AI能力差异的决定性因素。
3.2 数据标准挑战:AI"读不懂"企业数据
即使数据本身的质量合格,如果AI无法理解数据的业务含义,其输出价值依然有限。问题的根源在于,大多数企业的元数据管理停留在技术层面——表结构、字段类型、长度约束记录得很清楚,但字段的业务语义几乎空白。
例如,一个字段的元数据描述是"VARCHAR(50),不可为空",但字段名是amount。在ERP系统中它代表含税订单金额,在财务系统中它代表不含税实际收入,在CRM系统中它代表预估合同金额。AI无法从技术元数据中区分这三个"amount"的业务差异,跨表关联分析时就会出现口径混乱。
DCMM 2.0的数据标准域(业务术语、数据元、指标数据)正是解决这一问题的框架——当企业建立了统一的业务术语标准和数据元标准后,AI就能准确理解"这个amount在财务语境下是不含税金额",从而在跨表分析时做出正确的语义对齐。
3.3 组织认知挑战:AI和数据治理仍然是两拨人
在不少已经建立数据治理体系的企业中,存在一个结构性矛盾:治理团队的产出和AI团队的需求之间存在断层。
治理团队的工作成果——数据标准文档、质量评估报告、资产目录——以"汇报材料"的形式存在,AI团队看不到也用不上。AI团队从数据湖直接拉取原始数据,治理团队不知道他们在用什么数据、数据质量是否满足AI需求。"管"和"用"是两条平行线,各走各的路。
DCMM 2.0将数据治理组织、制度建设和数据文化建设列为核心能力域,意味着标准本身就预设了一个前提:数据治理首先是组织治理。L4的AI要求不是一个纯技术问题——如果治理团队和AI团队继续各行其是,AI辅助数据管理就缺乏组织层面的运行基础。
3.4 安全合规挑战:大模型放大了数据暴露面
DCMM 2.0将安全域的能力项从策略/管理/审计升级为合规管理/安全防护/安全审计,合规要求的显著增强并非偶然。
在传统BI环境中,数据权限控制可以精确到字段级——某个用户能看到哪些表、哪些字段、甚至能执行什么类型的查询,都可以通过权限体系精细管理。但在大模型的自然语言交互场景下,权限和输出的边界变得难以精细控制:用户的一个"帮我看看各区域的销售情况"可能在执行过程中访问了超出其权限范围的数据,模型在生成回答时也可能无意中暴露了敏感信息。
这也解释了为什么DCMM 2.0强调数据的分类分级和脱敏处理——数据在进入AI系统之前,建议先完成安全域的基础建设,否则AI的便利性与数据的安全性之间会形成一个难以调和的对立。
四、从L3到L4:三阶段实施路径
应对四大挑战的路径,可以归纳为三个阶段。每个阶段对应DCMM 2.0的不同能力域,各阶段之间既有先后关系,也有重叠推进的空间。
需要明确一个基本前提:DCMM 2.0是评估的"检查清单",理采存管用方法论是工程落地的"施工图纸"。标准告诉企业"应该具备什么能力",方法论告诉企业"怎么一步步把这些能力建起来"。两者之间的关系,从多数成功案例来看,通常是标准定目标、方法论定路径、产品定落地。
阶段一:夯实治理底座(理→管,约6-12个月)
这一阶段的核心目标是让AI"有数据可用、能读得懂数据"。具体包括四项基础工作:
数据资产目录建设:让AI知道企业有哪些数据,它们在哪里。这不是简单地把表名列出来,而是建立包含业务描述、数据归属、更新频率、质量状态的"数据地图"。
元数据补齐业务语义:为技术元数据补全业务含义——CRM系统中的amount代表"预估合同金额",DW中的amount代表"不含税实际收入"。这一步是AI理解数据的前置条件。
数据标准统一核心口径:在业务术语层面统一"客户""订单""收入"等高频概念的定义和口径,避免AI跨表分析时的语义歧义。
数据质量基线建设:对核心业务表建立基本的完整性、准确性、一致性质检规则,让AI输出的结果建立在可信数据之上。
这一阶段对应DCMM 2.0的数据架构、数据标准、数据质量三个能力域。以江西某国控集团为例,该企业10余套业务系统分散独立运行,监管数据质量缺乏管控。通过构建覆盖完整性、准确性、一致性、及时性、唯一性五个维度的稽核规则体系,半年内将核心数据质量问题的修复周期从两周缩短至两天(企业名称已脱敏,下同)。
阶段二:AI能力嵌入治理流程(管→用,约12-18个月)
底座夯实之后,将AI能力逐步嵌入数据治理的日常工作流。这个阶段的策略不是"全面铺开",而是选一个与业务痛点直接关联的场景先跑通:
在质量规则配置中引入AI推荐引擎。目前市场上已有部分数据治理平台(如龙石)在质量规则配置中内置了AI推荐引擎,系统根据字段特征自动推荐适用的校验规则,将配置效率提升10倍以上。
在分类分级中引入AI自动识别,替代人工逐字段标注。
在异常检测中引入AI模式识别,降低传统固定阈值告警的误报率。
在数据查询中引入AI自然语言交互,让业务人员用日常语言直接提问。
这一阶段对应DCMM 2.0的数据安全、数据应用流通两个能力域。关键成功因素不是技术选型,而是组织层面的"管用一体"——AI能力嵌入之后,治理团队的产出(标准、目录、质量基线)直接变成AI团队的输入(语义模型、查询接口、可信数据源),打破"管用分离"的结构性断层。
阶段三:形成量化管理与持续优化闭环(用→理,持续运营)
当AI能力在局部场景验证有效后,下一步是建立量化追踪和持续优化机制,真正实现L4所要求的"数据驱动管理":
建立覆盖486项指标中核心项的量化追踪体系,例如数据质量问题的自动发现率、修复周期的趋势变化、数据标准的实际覆盖率等。
构建运营闭环:用户反馈(点赞/点踩)→工单处理→知识库更新→模型优化。AI能力的准确率不是一成不变的——随着业务场景的扩展和用户反馈的积累,模型持续自进化。
江苏某国企数科的案例提供了一个参考样本。该企业承接M市数据要素流通平台的建设运营,汇聚了大量公共数据和市场化数据资源,面临"找数难、用数难、运营难"三大瓶颈。通过部署"感知-匹配-演进"三位一体AI智能体,分三阶段推进——知识体系与智能能力建设、应用集成与场景落地、运营闭环与持续优化——实现了基础咨询工单量显著下降、检索耗时大幅缩短、数据产品复用率明显提升。如客户所评价:"以前推数据产品像蒙着眼睛打靶,智能体给了我们一杆瞄准镜。"
这一阶段对应DCMM 2.0的数据资产、数据战略两个能力域。需要指出的是,数据治理的终点不是系统上线,而是组织真正具备持续用好数据的能力。这也是龙石数据"产品+培训+陪跑"模式的逻辑——培训解决"知道怎么做",陪跑解决"能自己做",最终目标是客户团队独立运转,而非依赖外部厂商。
五、结论
DCMM 2.0在L4量化管理级引入人工智能等先进技术,不应被解读为标准对企业的"增设门槛"。它的实质是将一个已在行业实践中反复验证的共识——数据治理的成熟度决定AI能力的天花板——通过国家标准的形式制度化。
从Data-Centric AI的理念验证,到大模型落地过程中反复撞上数据治理的墙,再到DCMM 2.0将AI能力写入评估框架,这三者指向同一个方向:数据治理正在从"IT部门的后台工作"演变为"AI战略的基础设施"。企业如果不能回答"数据在哪里、质量怎么样、标准是否统一"这三个问题,AI建设就始终缺乏地基。
对企业的实用建议可以归纳为三点。其一,"先理后AI"——AI能力在治理流程中的嵌入,应当建立在数据目录、元数据语义、标准口径和质量基线初步完备的基础之上。其二,"治理即AI基础设施"——元数据是AI理解数据的"翻译层",数据标准是跨表关联的"统一语义层",数据质量是AI输出可信度的"基准线",这三层不是治理的副产品,而是AI的底层依赖。其三,"管用一体"——打破治理团队和AI团队的组织壁垒,让治理产出直接服务于AI应用。
DCMM 2.0的实施只是一个起点。随着数据资产入表(财会〔2023〕11号)、"数据要素×"三年行动计划的推进,数据治理成熟度正在从"贯标评估的一个分数"变成企业数据能力的"硬通货"。对于志在L4及以上的企业,AI不是数据治理做完之后的锦上添花,而是数据治理能力本身的组成部分。
六、FAQ
Q1:DCMM 2.0在L4引入人工智能等先进技术,是否意味着企业必须自研AI?
不是。DCMM 2.0评估的是"是否具备人工智能辅助数据管理能力",而不是"AI是不是自研的"。企业可以通过引入成熟的AI数据治理产品和工具来满足这一要求,关键在于能力的存在和运行,而非能力的来源。
Q2:企业目前还在L2或L3,有必要现在关注AI吗?
有必要。L2→L3通常需要12-24个月,L3→L4同样需要12-18个月。如果等到冲刺L4时才开始考虑AI能力建设,时间窗口将非常紧张。较为稳妥的做法是在治理底座建设阶段就为AI能力预留接口——例如在搭建资产目录时就考虑AI的可访问性,在配置质量规则时就引入AI推荐机制。具体的三阶段路径已在第四节详述。
Q3:AI和数据治理到底谁先谁后?
不完全是先后关系。DCMM 2.0传递的信号是,AI不是治理做完之后的"锦上添花",而是治理能力发展到L4阶段的"内在要求"。但在实操层面,较为务实的做法是选一个高价值场景(如NL2SQL或质量规则推荐),先把该场景涉及的核心数据域的元数据和标准做扎实,跑通AI用数闭环,再横向扩展到其他场景。不是"等治理完美了再上AI",也不是"跳过治理直接上AI",而是"边治理边验证,以用促治"。
Q4:中小企业没有专门的AI团队,怎么满足L4的AI要求?
中小企业反而可能是AI在数据治理领域落地更容易的场景——团队规模小、数据量相对可控、没有"管用分离"的组织割裂。目前市场上已有部分产品(如龙石AI用数智能体)提供开箱即用的自然语言用数能力,集成DeepSeek和千问3等主流大模型,数据不出域。中小企业的主要工作不是组建AI团队,而是把核心数据域的治理底子打好——确保元数据说清楚业务含义、数据标准统一核心口径、核心表的数据质量达到可用水平。在此基础上,AI用数能力的部署和运行并不需要庞大的技术团队。
参考文献
[1] GB/T 36073-2025,《数据管理能力成熟度评估模型》(DCMM 2.0), 国家市场监督管理总局、国家标准化管理委员会, 2025年12月31日发布
[2] DAMA International,《DAMA-DMBOK: Data Management Body of Knowledge, 2nd Edition》, Technics Publications, 2017
[3] GB/T 36344-2018,《信息技术 数据质量评价指标》, 国家市场监督管理总局、国家标准化管理委员会, 2018
[4] Andrew Ng et al., "Data-Centric AI", https://datacentricai.org/
[5] 财政部,《企业数据资源相关会计处理暂行规定》(财会〔2023〕11号), 2023年8月
[6] 国家数据局,《"数据要素×"三年行动计划(2024—2026年)》, 2023年12月
[7] 《中华人民共和国数据安全法》, 2021年9月1日施行