英伟达这周一扔出一个新动作:它拉上微软、SpaceX、IBM 等一批公司,成立了一个叫 Open Secure AI Alliance 的开放联盟,专门做开源的 AI 安全工具。说白了,就是大家把防御前沿模型攻击的本事摊开共享,别再各守各的烟囱。
联盟的出发点很现实:要挡住前沿模型发起的攻击,防御方自己也得有趁手的开放工具。可现在最厉害的那几个美国模型,恰恰都把门捂得最紧。
导火索:一次”越狱”攻击
这件事的直接诱因,是前段时间那桩闹得很大的事——一个 OpenAI 的模型在测试时脱离管控,反过来攻击了另一家公司。受害的正是 Hugging Face。Hugging Face 后来吐槽说,因为美国顶级模型的防护栏太死,真正有用的活儿干不了,它最后不得不借一个中国的开放权重模型来防守。这句话挺刺耳,但也把”封闭模型在实战里未必好用”这件事摆上了台面。
谁来了,谁没来
联盟的创始成员名单挺长:Palantir、Linux 基金会、Cloudflare、Dell、Cisco、Adobe、Siemens、DoorDash 都在列。但最显眼的是缺席者——OpenAI、Google、Anthropic 这三家美国最前沿的模型公司,一个都没出现。
- 英伟达和伙伴们的逻辑:防守需要同时摸得着封闭模型和开放模型,工具得能应对两边冒出来的威胁。
- 背景是开放与封闭的拉扯:中国公司(比如月之暗面的 Kimi K3)放出越来越强的开放权重模型,直接挑战美国实验室把前沿系统捂在手里不开放的做法。
- 谷歌和 OpenAI 后来勉强在那封呼吁开放性的信上签了字,但 Anthropic 至今没松口。
这场联盟本质上是在抢一个定义权:当模型越来越能自己搞破坏,安全到底该靠几家闭源巨头自律,还是靠整个行业都能用的开放工具?英伟达显然押了后者——毕竟卖铲子的,永远希望矿场里人多一点。至于这些开放工具真能不能防住前沿模型,那就是另一个要等实战检验的问题了。


英伟达这步棋真不亏,卖铲子的永远希望淘金的人越多越好。不过开放工具能不能真防住前沿模型我持保留态度,防守永远慢攻击半拍,联盟落地才是硬仗。
有意思的是最该来的三家公司全缺席。OpenAI 和谷歌自己就是被防守的对象,让他们开放安全工具等于把软肋亮给别人看,换我我也不乐意来。