Anthropic上周五把Opus 5端了出来。这是它家做了很多年的重量级主力模型的最新版本,节奏快得有点吓人——距离5月28日Opus 4.8上线才过去两个月,6月又连发了Mythos 5、Fable 5和Sonnet 5。整个5系列现在就剩轻量级的Haiku还没轮到升级。

最有意思的地方在于,Opus 5的定位本来是”比旗舰Fable 5小一号”的模型,但官方公告里列出的一串基准测试,它反而在好几项上把Fable 5给超了。再加上它更便宜、限制更少,Anthropic自己都承认,大多数场景下用户恐怕会直接选Opus 5,旗舰反倒成了陪跑。
官方说法是,Opus 5″在验证自己的工作、反复迭代直到成功这件事上强了很多”。测试里它拿到一个信息不全的提示词,硬是自己写完了一整套计算机视觉流水线。
Fable身上的枷锁,Opus 5基本没有
Fable 5发布以来一直被各种限制拖累,最挨骂的是那条30天数据保留政策——出于安全考虑,Fable和Mythos的对话数据要强制留存30天,注重隐私的用户对此意见很大。Opus 5和它的前代一样,完全不受这条政策约束。
安全分类器的触发频率也差了一个量级。Anthropic预计,同样的使用场景下,Opus 5触发安全拦截的次数会比Fable 5少85%。逻辑很直白:能力弱一档的模型,管得就松一点。
网络安全的红线还在,但画得更细了
当然,护栏没有全拆。围绕漏洞利用、渗透测试这类网络安全任务,Opus 5仍然有明确禁区,只是边界画得比以前精细:
- 不允许拿它去扫描软件二进制文件里的漏洞——这种操作大概率是攻击行为;
- 但允许在源代码里找漏洞——有源码在手,多半是防御方在做代码审计;
- 这种”按意图划线”的思路,比过去一刀切的封禁友好得多。
被拦了也不报错,自动降级给你答案
这次还有个挺实用的新功能叫Automatic Fallbacks,目前是测试版、需要主动开启。它解决的是一个老痛点:提示词一旦触发安全分类器,API用户以前收到的是一条冷冰冰的报错。开了这个功能之后,请求会被自动转给一个能力弱一些的模型来回答,你至少能拿到一个能用的结果,而不是空手而归。此前就有安全研究员抱怨,AI护栏正在实打实地妨碍他们做攻防研究,这个功能算是Anthropic给出的一个折中方案。
把这些拼在一起看,Anthropic的产品策略已经很清楚了:旗舰Fable负责冲能力上限、顶着最严的监管;Opus负责走量,用八成五的宽松度和更低的价格接住绝大多数真实需求。跑分还反超旗舰这件事,与其说是意外,不如说是故意留给市场的一个信号。

小模型跑分反超旗舰,说明Fable那套重限制真的在拖后腿。二进制不让扫、源码可以审,这条线画得其实挺讲究——攻击者一般拿不到源码,拿得到源码的多半是自己人。就是不知道85%这个数字实际用起来水分多大。
两个月迭代一代,这节奏比手机厂商发新机还狠。不过我更在意的是Automatic Fallbacks这个设计,被安全分类器拦下来不给报错、自动换个弱点的模型接着答,对做API集成的人来说太实用了,省得在代码里写一堆异常兜底。