2026 年 9 月,欧洲 AI 办公室联合多国市场监督机构,对简历筛选、信贷评估与医疗分诊等高风险 AI 系统启动了协同合规检查。据 AI Governance Institute 汇编,这次行动把三类直接触及个人重大利益的系统推到了台前,也标志着欧盟的 AI Act 正从「立规」走向「真执法」。这也是 AI 办公室自履职以来,头一回以协同方式把执法资源跨成员国集中投放到具体应用场景,信号意义大于单案处罚。对智能体赛道来说,这意味着带自主决策的系统开始被拿来压力测试。

首批协同检查:三类高风险 AI 成靶子简历筛选自动化简历排序歧视与偏差高风险需文档与审计轨迹AI Act 高风险清单信贷评估信用评分自动化影响个人金融准入决策可解释性要求AI Act 高风险清单医疗分诊就诊优先级排序关乎生命安全需快速整改计划AI Act 高风险清单检查要点:缺文档、缺审计轨迹、缺快速整改计划的机构成为主要目标据 AI Governance Institute 汇编,欧洲 AI 办公室联合多国市场监督机构于 9 月启动意义:从「立规」走向「真执法」,高风险场景先被拿来压力测试
图 1|三类都属 AI Act 高风险清单,检查的不是模型聪不聪明,而是部署方有没有留痕与兜底。

为什么是这三类:都在 AI Act 高风险清单上

被选为靶子的三类有一个共同点:它们都落在 AI Act 的高风险清单里,且自动决策会显著影响个人。简历筛选涉及歧视与偏差的高风险,信贷评估决定个人金融准入,医疗分诊关乎生命安全。对监管者而言,这些系统的检查重点不是模型聪不聪明,而是部署方有没有把过程留痕、有没有兜底。一旦算法在筛选、授信或分诊里出错,影响的是真实的人生与资产,所以文档、审计轨迹与可解释性成了硬性要求,而不是加分项。

检查什么:文档、审计轨迹、整改计划

据汇编,检查的主要目标集中在四类软肋:缺少完整的文档与模型卡、缺少可追溯的审计轨迹、缺少快速整改与回滚计划、缺少数据保护影响评估。对带自主决策的系统来说,评测与留痕正从可选项变成上线的先决条件。换句话说,企业不能只证明「模型跑得动」,还得证明「出错时能发现、能上报、能回滚、能交代」。这与过去几年行业重能力、轻治理的取向形成了直接对冲。

对部署方的合规清单:从「能跑」到「能交待」要补的课完整文档与模型卡可追溯的审计轨迹快速整改与回滚计划数据保护影响评估与美式路径对照美:FTC 以现职权发执法信号欧:AI 办公室直接进场检查共同点:把智能体当企业行为责任落在部署方而非模型对智能体赛道:带自主决策的高风险系统首当其冲,评测与留痕从可选项变上线的先决条件采购侧:政府 / 金融机构会把可审计作为硬性门槛,倒逼厂商补齐治理提醒:上述执法细节由汇编机构转述,具体清单以欧盟官方通报为准
图 2|当检查真的进场,能证明「何时发现、如何上报、为何未报」比模型指标更关键。

具体怎么查:从抽查到运行轨迹核验

据汇编透露,检查并非只做桌面审阅,而是结合成员国市场监督机构的抽查与文件核验:检查方会索要模型卡、风险评估、日志样本与整改记录,并关注系统是否真的能在运行中记录每一次自动决策的输入、输出与触发条件。对智能体这类带自主决策的系统,关键不只是「有没有文档」,而是「文档能不能对应到真实运行轨迹」——一份漂亮的模型卡若对不上生产日志,反而会成为合规反证。这也解释了为什么审计轨迹被单列成硬要求:它既是事后追责的依据,也是部署方证明自己尽到注意义务的直接证据。更现实的一点是,这次协同检查把过去各国各自为政的监督拧成一股绳,意味着跨境部署的企业要面对的是统一标准下的联合审视,而不是逐国可钻的口径缝隙。

与美式路径对照:欧盟进场检查,美国发执法信号

把镜头拉宽,欧盟与美国的路径形成有趣对照:欧盟是 AI 办公室直接联合市场监督机构进场检查,美国则更多由 FTC 以现有职权发出执法信号,强调部署企业不会因用了智能体而被稀释责任,挥锤的人才该被追责。两边的共识是同一句话——把智能体当作企业的行为,而不是独立的行动主体,责任最终落在部署方而非模型厂商身上。这种共识正在重塑采购:政府机构和金融机构会把「可审计」当成硬性门槛,倒逼上游厂商补齐治理。

对赛道的影响:能证明「何时发现、如何上报」比指标更关键

对智能体赛道最实在的影响,是合规从纸面要求变成采购门槛。当检查真的进场,企业能不能证明「什么时候发现的问题、怎么上报的、为什么没报」,比任何跑分都更关键;而带自主决策的高风险系统会首当其冲,评测、留痕、权限与审计一体成为上线的前置条件。需要提醒的是,上述执法细节由汇编机构转述,具体清单与范围仍应以欧盟官方通报为准;但方向已经清楚:智能体进入高风险场景,先过的不是技术关,而是治理关。