8月3日,白宫宣布了一项重大进展:针对先进AI模型的自愿性评估框架已按期完成。然而,这一消息并未带来行业期待的透明度,反而引发了更多的疑问。

这项框架源自美国总统特朗普6月2日签署的“促进先进人工智能创新与安全”行政令。行政令要求制定一套机密基准测试流程,用于评估AI模型的网络能力,并确立“涵盖前沿模型”的认定门槛。根据该流程,参与企业可在模型公开发布前,自愿向政府提供最多30天的提前访问权限。虽然行政令强调参与是“自愿的”,但机密基准、未披露门槛与30天政府预览窗口的结合,实际上形成了一道企业无法公开评估或挑战的“事实闸门”。

但框架完成的同时,白宫也对内容讳莫如深。一名白宫官员表示:“6月2日行政命令中概述的自愿性框架已在截止日期前完成”,“目前正在与行业讨论下一步计划”。当被追问为何不公开时,该官员称:“仅仅因为某些东西不属于机密,并不意味着我们要向所有人广播”。

更值得关注的是,包括OpenAI、Anthropic和谷歌在内的主要AI公司,目前均未看到框架的完整内容。这三家公司在7月下旬曾共同审阅了一份草案并提交了修改意见,但最终版本至今未向行业或公众发布。

白宫计划于8月4日(周二)与相关企业举行一次工作人员级别的会议,对这一框架进行审查。据知情人士透露,OpenAI、Anthropic、谷歌和Meta预计都将出席。框架本身虽未被列为机密,但用于评估模型网络攻击能力的基准测试流程以及适用模型的门槛均被列为机密。

这一做法引发了政策制定者和AI安全倡导者的担忧。他们原本预期能看到相关细节,但白宫以“安全”为由选择了保密。有分析指出, “自愿且不公开”的状况让外部难以评估——未被纳入讨论的小型实验室无从知晓“前沿”的定义是否适用于自己,民间社会组织也无法挑战他们无法阅读的基准。

对于参与起草的核心企业而言,这或许是一种务实的安排:自愿的政府提前访问,远比华盛顿可能制定的许可制度友好得多。但对于整个行业而言,一个由少数头部企业参与制定、却对公众和其他竞争者保密的评估框架,其公平性与透明度正面临着前所未有的审视。