🤖 全球AI监管正在从原则倡议进入制度执行阶段。监管机构不再只关注模型“是否安全”,而是要求企业证明训练数据、风险评估、人工监督、运行日志和事件响应均已形成可核验的证据链。对于招聘、医疗、信贷、教育、公共服务及关键基础设施等高影响场景,合规审计正逐渐成为模型上线和持续运营的重要门槛。
🌍 监管落地呈现三条主线
第一条主线是风险分级。欧盟《人工智能法案》按照风险程度设置差异化义务,将可能威胁安全、健康或基本权利的特定系统纳入高风险管理。相关要求不仅面向欧盟企业,也可能覆盖向欧盟市场提供模型或系统的境外主体。企业需要同时判断自身是模型提供者、系统部署者、进口商还是分销商,因为不同角色承担的责任并不相同。可参考欧盟委员会AI法案说明。citeturn1search10turn1search11
第二条主线是基础模型问责。欧盟通用目的人工智能模型义务已于2025年8月2日起适用。一般通用模型提供者需要准备技术文档、实施版权合规政策,并公开训练内容摘要;被认定具有系统性风险的模型还要承担风险评估、严重事件报告和网络安全保护等额外责任。欧盟委员会的执法权于2026年8月2日起适用,这意味着合规工作已经从准备阶段进入可监督、可处罚的新阶段。相关范围和时间节点可查看通用模型提供者指南。citeturn1search7turn1search12
第三条主线是内容透明和来源追溯。中国《人工智能生成合成内容标识办法》自2025年9月1日起施行,针对文本、图片、音频、视频和虚拟场景等内容,明确显式标识、文件元数据隐式标识以及传播平台核验责任。企业不能只在页面上增加一句“AI生成”,还应检查下载、复制、导出和跨平台传播后,标识是否仍然完整。具体要求可查阅标识办法全文。citeturn1search19turn1search22
🔍 高风险模型审计正在发生哪些变化
从一次验收转向持续审计
传统审计常在系统上线前集中检查一次,但模型可能因数据漂移、提示词变化、插件接入、检索库更新或版本升级而改变实际风险。新型合规审计更强调全生命周期管理,包括上线前评估、运行监测、定期复审和重大变更再评估。模型版本、数据版本、测试结果和审批记录需要相互对应,避免出现“报告审的是旧模型,线上运行的是新模型”的证据断层。
从准确率测试转向多维风险测试
高风险系统不能仅凭总体准确率证明可靠。审计人员会进一步检查不同人群之间是否存在明显结果差异,系统在异常输入、越权提示和对抗攻击下是否稳定,以及人工复核机制能否真正纠正错误。美国NIST的AI风险管理框架以治理、映射、测量和管理为核心,并提供生成式AI风险画像,可用于组织内部建立统一的测试语言,但它属于自愿框架,不能替代具体司法辖区的法定义务。可参考NIST AI风险管理框架。citeturn1search13turn1search14turn1search17
从企业自述转向可验证证据
“我们重视安全”不再是充分证据。审计通常需要查看数据来源清单、授权依据、模型卡、风险登记册、红队测试、偏差分析、人工介入记录、供应商材料和事件处置工单。纽约市Local Law 144就是典型案例,雇主或职业介绍机构使用符合定义的自动化就业决策工具前,需要完成偏差审计、公开结果摘要并向候选人提供通知。审计应在使用前一年内完成,具体规则可查看纽约市官方说明。citeturn1search25turn1search26turn1search29
🧭 企业可以立即执行的合规步骤
- 建立AI资产台账。登记模型名称、版本、用途、部署地区、用户群体、供应商、输入输出数据及负责人,影子AI工具也应纳入盘点。
- 进行场景级风险分类。不要只给基础模型定级,还要评估它在招聘、授信、诊疗或客户服务等具体场景中的决策影响。
- 建立证据目录。将法规要求映射到制度、测试报告、日志字段、审批记录和用户告知页面,确保每项控制都有责任人和更新时间。
- 审查训练及检索数据。核验数据来源、知识产权依据、个人信息处理条件、清洗规则、代表性和更新机制,并记录问题数据的删除过程。
- 实施独立性检查。高风险项目应适当区分开发、测试、审批和审计角色,必要时引入具备专业能力的外部评估机构。
- 设计持续监测指标。跟踪错误率、群体差异、人工推翻率、投诉、越权调用、标识丢失和重大事件,达到阈值后自动触发复核。
合规审计的核心不是堆积文件,而是证明企业能够持续发现风险、采取控制措施,并在模型发生变化后及时重新评估。📌
✅ 总结
全球AI治理正在形成共同方向,即风险分级、模型透明、数据可追溯、人工监督和持续问责,但各地在适用范围、审计程序和执法方式上仍有明显差异。企业不宜简单复制一套全球模板,而应建立统一的内部控制底座,再叠加欧盟、中国、美国州级规则及行业监管要求。越早把合规要求转化为产品流程、技术日志和责任分工,越能降低后期整改成本,并把可信、安全和可审计能力转化为进入高价值市场的竞争优势。🚀