摘要:8月5日,由英伟达牵头的开放安全人工智能联盟(OSAA)成立首个工作组SAFE,聚焦AI安全事件的保密上报、受影响方通知与无责复盘分析。联盟已汇聚超120家企业,成员正贡献开源安全工具链。OpenAI、Anthropic、谷歌尚未加入。
成立仅一周的开放安全人工智能联盟(OSAA)正以惊人的速度推进AI安全生态建设。
据TechCrunch报道,由英伟达牵头的OSAA已汇聚超过120家企业,并正式成立首个工作组——Shared AI Findings Exchange(SAFE)。该工作组由Linux基金会负责管理,已开始公开征集AI安全事件处理提案。
从公开信到联盟:一周内的迅速落地
这一进展与近期围绕开源AI的监管讨论密切相关。7月24日,英伟达CEO黄仁勋在X平台发布人生首条推文,附上一封由微软、Meta等200余家科技公司联合签署的公开信,反对政府对开源模型实施过早限制。一周后,OSAA正式成立,英伟达、思科、CrowdStrike、Hugging Face和红帽等成为核心成员。
TechCrunch评论称,OSAA的快速推进与特朗普政府此前考虑禁止中国开源权重模型的动向直接相关——正是这一威胁促使了行业公开信的诞生。
SAFE工作组:保密上报、无责复盘、生态共享
SAFE工作组提出的提案涵盖了AI安全事件处理的完整闭环:
第一,保密上报机制。建立对AI安全事件及“险情”进行保密收集和分析的渠道,鼓励成员在发现或怀疑AI模型或智能体未经授权访问、利用或破坏第三方系统时主动上报。
第二,受影响方通知流程。明确向受影响方发出通知的标准化程序,确保信息及时传达。
第三,无责复盘分析。构建以复盘和改进为导向的事后分析框架,聚焦学习而非追责。通过识别反复出现的控制失效,发布基于证据的运营建议,降低整个AI生态的系统性风险。
联盟还确立了五项指导原则:开放与问责并存、开放学习、基于风险的响应、成员主权、学习与执行分离。
开源工具链:从模型到治理的完整栈
除制定协作规范外,OSAA成员还在持续贡献开源安全能力。
英伟达提供了完整的开放模型家族——包括面向智能体AI的Nemotron、物理AI的Cosmos、机器人领域的Isaac GR00T等——以及开源大语言模型漏洞扫描工具Garak。英伟达还贡献了NVIDIA Labs面向对象智能体研究Harness和OpenShell运行时,用于限制智能体的可见与操作范围。
其他成员的贡献同样关键:Okta推进Agent身份技术,红帽研发Agent治理方案,亚马逊贡献了Strands Agents智能体构建工具和Cedar授权语言。联盟计划逐步形成可供企业部署的开源AI安全工具链,用于保护AI智能体及应对恶意AI攻击。
行业格局:巨头已入场,三家缺席
目前OSAA成员已覆盖Adobe、贝莱德、思科、英特尔、微软、Visa等企业。但值得注意的是,OpenAI、Anthropic和谷歌尚未加入——尽管OpenAI与谷歌均签署了此前由英伟达发起的支持开源AI公开信。Anthropic的缺席并不意外,其CEO阿莫代伊此前已明确不主张禁开源,但在算力管控、蒸馏与发布前测试等问题上持不同立场。
业内认为,OSAA加速推进开放协作与安全标准建设,有望通过开放共享提升AI安全能力与产业竞争力。在AI安全事件频发的背景下——从OpenAI智能体入侵Hugging Face到Claude会话分享链接被搜索引擎公开索引——行业对共享防护机制的需求已从理论讨论变为现实紧迫。



