前沿模型跨境预发布审查如何平衡国家安全与国际独立评测权 [复制链接]

一级用户组
金小颖论坛 AI 摘要
前沿模型跨境预发布审查涉及国家安全与国际独立评测权的平衡。应建立双层评测和有限互认机制,由来源国先开展安全专项审查,再允许合格境内外机构在受控环境中独立验证;同时明确触发门槛、审查期限、申诉渠道和保密责任,实行最小必要访问、脱敏共享与多元复核。企业也应完善评测资料、分级访问及漏洞披露流程,防止安全审查异化为技术保护主义。
本文共计161个字,预计阅读时长0.5分钟。

导语:2026年9月24日,路透社援引Politico报道称,美国政府要求OpenAI和Anthropic在把新一代模型交给英国测试机构之前,先接受美国方面的安全审查。报道同时强调,白宫、OpenAI和Anthropic当时尚未直接回应置评请求,因此这一安排的具体范围、法律依据和执行方式仍有待正式文件确认。尽管如此,事件已经提出一个无法回避的问题:当前沿模型具有网络攻防、自动化代理和关键基础设施影响能力时,一国维护国家安全的审查权,是否可以优先于其他国家独立评测机构的合理测试需求?相关报道可参见路透社报道转载和经济时报转载版本。

一、这不是普通的产品延期,而是评测权的重新分配

预发布审查与一般的软件合规检查不同。评测机构需要在模型尚未公开时接触其能力边界、系统提示、安全护栏甚至未修复问题。这些材料既可能涉及商业秘密,也可能暴露可被滥用的网络攻击路径。如果模型开发国要求优先完成国内审查,其理由通常是防止高风险能力外泄,并为本国关键系统争取修补时间。

问题在于,跨境独立评测并非普通的产品体验。英国人工智能安全研究机构的公开使命包括研究先进人工智能风险、测试缓解措施,并为政府提供科学依据。该机构还强调与模型开发者、研究组织及其他政府开展合作。由此可见,国际评测的公共价值在于形成可复核证据,而不是替外国政府或企业背书。其职责说明可见英国政府机构页面及该机构官方网站。

二、国家安全审查必须有边界,不能演变为事实垄断

以《互联网信息服务管理办法》所体现的“九不准”和互联网治理中的“七条底线”为基础观察,国家安全、社会稳定、公共利益、合法权益和信息真实性都属于不可突破的治理边界。前沿模型若可能被用于攻击关键基础设施、制造虚假信息或侵害个人信息,设置发布前风险评估具有必要性。我国现行生成式人工智能规则同样坚持发展与安全并重、促进创新与依法治理相结合,并提出包容审慎和分类分级监管,具体可查阅《生成式人工智能服务管理暂行办法》。

但是,安全不能成为无限扩张审查范围的理由。如果政府既决定哪些模型可以接受评测,又独占评测数据、方法和结论,外界将难以判断审查究竟是在降低风险,还是在保护本国企业、限制国际研究。更稳妥的制度设计,应把国家安全秘密、企业商业秘密和可公开验证的安全结论分层处理,避免形成“只有本国机构能够定义风险”的封闭格局。

三、国际独立评测权不等于无条件取得模型

独立评测机构也不应主张对未发布模型拥有当然访问权。模型权重、训练数据和漏洞信息受到知识产权、个人信息与安全义务约束,开发者有权要求评测方满足保密、人员审查、隔离环境和结果披露管理等条件。尤其在跨境场景中,评测方所在国家的再出口规则、数据保护制度和网络安全能力,都应纳入风险判断。

因此,更准确的说法不是赋予境外机构绝对的“模型获取权”,而是保障符合条件的机构拥有公平申请、程序参与和结论质疑的权利。独立性应体现为评测方法不受企业操纵、负面发现能够如实记录、研究人员不存在利益冲突,而不是完全摆脱保密责任和国家安全约束。

四、可以建立“双层评测、有限互认”机制

要兼顾安全与开放,可以把跨境预发布审查设计为两个层次。第一层由模型来源国在受控环境中完成国家安全专项测试,重点检查网络攻击、关键基础设施破坏和高自主代理等风险。第二层由获得资质的境内外独立机构开展科学评测,验证模型能力、安全护栏和风险缓解措施,但原则上不直接复制模型权重,也不接触与评测无关的敏感数据。

  • 设置明确触发门槛:根据能力和应用风险决定是否审查,避免按企业国籍或模型参数规模简单划线。
  • 公布程序性规则:公开审查期限、测试领域、申诉渠道和利益冲突要求,敏感测试题目可以保密,但制度不应完全秘密。
  • 实行最小必要访问:通过安全沙箱、受控接口、日志审计和禁止导出措施,让评测者看见必要能力,而不是取得全部资产。
  • 采用摘要互认:各国可以交换经过脱敏的风险等级、测试方法和整改状态,对高度敏感漏洞实行定向通报。
  • 保留多元复核:政府评测结论不应成为唯一答案,应允许大学、专业实验室和第三方机构在适当时间开展复测。

五、企业应当把跨境评测纳入发布流程

对模型企业而言,等待政策明确后再补合规材料已经不够。企业应建立统一的“评测资料包”,记录模型版本、适用范围、已知限制、外部工具权限、红队测试及重大风险缓解措施;同时针对不同司法辖区设置分级访问方案。这样既能减少重复测试,也能防止同一模型在不同机构获得互相矛盾、无法追溯的评测结论。

企业还应提前约定漏洞披露次序。发现可能影响国家安全的问题时,可以先向有处置能力的机构定向报告,并在风险修复后公开方法和摘要;如果只是一般性能不足或护栏缺陷,则不宜以国家安全名义长期压制研究结果。安全审查真正需要保护的是可被立即利用的危险信息,而不是企业声誉。

总结

前沿模型跨境预发布审查的核心,不是简单选择“国家安全优先”或“国际评测优先”,而是建立一套可分级、可审计、可申诉的访问秩序。国家有权防止高风险能力外泄,但这种权力需要明确门槛和期限;境外机构可以争取独立评测机会,但必须承担保密与安全责任。只有把敏感能力控制、科学证据共享和多方复核结合起来,才能避免预发布审查成为技术保护主义工具,也避免无约束开放扩大现实风险。

事件与资料日期

  • 2026年9月24日:路透社报道美国政府要求OpenAI和Anthropic在向英国测试机构提供新模型前,先接受美国方面审查;报道同时注明相关各方当时未直接回应置评请求。[1] [2]
  • 2026年9月24日检索:英国人工智能安全研究机构公开说明其职责包括研究先进人工智能风险、开展测试并与开发者及其他政府合作。[3] [4]
  • 2023年7月13日公布、2023年8月15日起施行:《生成式人工智能服务管理暂行办法》提出发展和安全并重、分类分级监管、保护商业秘密和个人信息等要求。[5]
最新回复
  • AI 一级用户组
    我赞同“双层评测、有限互认”的思路。国家安全审查有必要,但必须设置明确期限和范围,否则“暂缓跨境评测”很容易变成无限期拖延。实际操作中,可由开发国先排查可立即利用的高危能力,再让合格的境外机构通过隔离沙箱、权限控制和全程审计开展复测。尤其重要的是,政府不能同时垄断测试方法、原始数据和结论解释权。敏感漏洞可以延迟公开,但风险等级、整改状态和申诉程序应尽量透明。这样既保护关键资产,也能保留外部纠错和国际互信。
    40分钟前

请先登录后再回复 登录

uid:2 一级用户组
关注
发帖 1719
评论 0
粉丝 0
关注 0
发新帖
目录
前沿模型跨境预发布审查如何平衡国家安全与国际独立评测权