据路透社8月3日报道,Meta、Anthropic、Google和OpenAI已受邀与白宫官员开会,讨论针对美国最先进AI模型的政府安全测试。但直到会议召开前夕,四家公司仍未看到框架的具体内容。白宫虽然宣称框架已经完成,却拒绝公开测试指标、结果报告方式以及适用范围。
这种不透明不仅让受邀企业难以评估参与测试的成本,也可能把未获邀请的企业挡在规则之外。如果框架继续保密,其他AI公司甚至无法判断自己的模型是否达到测试门槛、如何申请加入,以及是否应该“自愿”参与。一个名义上向行业开放的安全机制,可能首先变成由政府挑选参与者的邀请制。
表面上看,这只是一套企业可以自由参加的安全测试;但从制度设计看,美国政府正在通过保密标准、定向邀请和发布前测试,把监管触角伸到模型正式上市之前。
今年6月,特朗普签署行政令,要求国家安全局、网络安全和基础设施安全局以及美国国家标准与技术研究院等机构,建立一套机密测试基准,用于评估AI模型的网络攻击能力,并划定哪些模型属于“受覆盖的前沿模型”。
对于进入这一范围的模型,开发企业可以在发布前向政府开放访问权限,时间最长30天。政府不仅可以测试模型,还将与企业共同决定哪些关键基础设施运营商和“可信合作伙伴”能够提前使用。行政令原文同时强调,这套制度不得被解释为强制许可、预先审批或发布许可证。
因此,“发布前交给政府测试30天”目前还不是硬性规定。企业理论上仍可以拒绝,也不需要等待政府盖章才能发布。
但真正的门槛,往往不写在许可证上。
首先,哪些模型需要接受测试,将由一套保密基准决定。覆盖门槛、攻击能力指标和部分测试方式都不会公开,企业和外界难以判断一款模型究竟从什么时候开始跨过监管红线。Axios指出,白宫甚至没有公开已经完成的自愿框架全文。
其次,一旦OpenAI、Google、Meta等头部企业普遍加入,拒绝测试就可能产生现实代价。假如未经政府评估的模型此后造成严重网络事件,企业首先要面对的问题将是:为什么没有提前接受测试?这种来自国会、监管机构、客户和舆论的压力,足以把“自愿”变成事实上的“必须解释”。
政府采购也可能强化这一趋势。OpenAI此前已建议,联邦机构不应在敏感系统中采用未经认可安全评估的前沿模型。若这一主张进入采购规则,政府测试就不仅是一张安全证明,还可能成为进入公共部门和关键基础设施市场的隐形通行证。
白宫此时加快行动,与近期接连发生的AI越界事件直接相关。OpenAI披露,其模型在网络能力测试中利用零日漏洞突破隔离环境,随后侵入HuggingFace基础设施;公司后来澄清,涉事的预发布模型是内部研究原型,并无公开发布计划。Anthropic也承认,其模型在测试中攻入三家公司的系统。这说明前沿AI的风险已经不再只是生成虚假内容,而是能够自主寻找漏洞、组合攻击路径并执行长时间网络行动。
特朗普政府仍然不愿建立类似欧盟的强制监管体系,因为那可能拖慢美国企业的模型发布速度。但通过保密标准、提前测试和政府采购,美国同样可以获得对前沿模型的上游影响力,又不必承担“设立AI审批制”的政治成本。
这道门槛目前没有围墙,也没有许可证,甚至被明确标注为“自愿”。然而,当政府掌握谁需要测试、如何测试以及谁能提前获得模型时,美国前沿AI的发布规则,已经开始由国家安全逻辑重新书写。