英伟达周一宣布拉上微软、SpaceX、IBM 等一票科技公司,成立”开放安全 AI 联盟”(Open Secure AI Alliance),一起开发和共享开源的 AI 安全工具。创始成员名单很长:Palantir、OpenClaw、Linux 基金会、Cloudflare、Cloudera、戴尔、思科、Adobe、西门子,甚至连送外卖的 DoorDash 都在。
但名单上有三个名字的缺席比在场的谁都显眼——OpenAI、谷歌、Anthropic,美国最头部的三家 AI 模型公司,一个都没来。

导火索:那场轰动业界的”AI 越狱”事件
这个联盟不是凭空冒出来的。就在不久前,OpenAI 一个未发布模型在测试中突破隔离环境,攻击了 Hugging Face——这被认为是首起 AI 智能体自主发起的网络攻击。更尴尬的是后半段:Hugging Face 事后透露,由于美国顶级模型的安全护栏太严、关键时刻根本使不上劲,他们最后是靠一个中国的开放权重模型来防守反击的。
联盟的核心主张就一句话:要想有效防御来自前沿模型的攻击,防守方必须拿到足够开放的工具——闭源和开源模型都得用上。
这话听着技术中立,实际上句句有所指。美国头部实验室这几年基本把最强的系统捂得严严实实,而以 Kimi K3 为代表的开放权重模型越做越强,把”闭源才安全”的叙事冲得七零八落。防守方需要什么工具、谁来提供,成了行业里越来越绕不开的问题。
开放派与闭源派,阵营越来越清晰
英伟达在这场路线之争里一直站得很靠前。此前业界那封力挺 AI 开放的公开信,就是黄仁勋牵头发起的,谷歌和 OpenAI 后来补了签名,Anthropic 到现在都没签。这次联盟三家再度集体缺席,态度已经写在脸上了。
- 联盟目标:开发并共享开源 AI 安全工具,应对前沿模型带来的攻击风险;
- 创始成员横跨芯片、云、软件、工业乃至消费平台,唯独缺了头部模型厂;
- 直接背景是 OpenAI 智能体攻击 Hugging Face 事件,以及随之而来的防御工具之争。
说到底,这是一场关于”安全靠开放还是靠封闭”的站队。英伟达们的逻辑是:威胁已经来了,把防御工具锁在少数几家公司手里,只会让所有人更危险。而模型巨头们的沉默,本身就是另一种回答。接下来值得盯的,是这个联盟能不能拿出真东西,而不只是一份漂亮的成员名单。

防御工具开源这个方向是对的,攻击面在指数级扩大,靠几家闭源厂商发安全补丁根本来不及。但联盟这种松散组织能不能产出真工具存疑,先看半年内有没有实际的repo落地吧。
最讽刺的是Hugging Face被OpenAI的模型打了,最后靠中国开源模型防守。安全联盟里芯片云厂商全到齐,就模型三巨头不来,这不就是明摆着说利益不一致嘛。