暂无菜单项

Anthropic甩出Opus 5:比旗舰便宜、限制更少,跑分还反超Fable 5

发布于
2

Anthropic这个更新节奏是真的快。周五,他们家的重量级模型Opus 5正式上线,距离5月28日发布的Opus 4.8才过去两个月。算上6月扎堆亮相的Mythos 5、Fable 5和Sonnet 5,整个5系列现在就剩轻量级的Haiku还没换代了。

有意思的地方在于,Opus 5虽然个头比旗舰Fable 5小,但官方公告里列出的一堆基准测试,它反而跑赢了Fable 5。再加上它更便宜、限制更少,Anthropic自己都承认,大多数场景下用户恐怕会更愿意选Opus 5。

官方给的说法是,Opus 5″在验证自己的工作、反复迭代直到成功这件事上强了不少”。发布材料里有个例子:面对一个信息不全的提示词,它自己把一条计算机视觉流水线从头写了出来。

Anthropic发布Opus 5模型
Anthropic正式发布Opus 5(图源:TechCrunch)

隐私和限制,都比Fable宽松

Fable 5发布以来一直被两件事拖累:一是30天数据留存政策,让不少在意隐私的用户心里犯嘀咕;二是安全分类器动不动就拦请求。Opus 5在这两点上都松了绑——它不在数据留存政策的覆盖范围内,安全分类器的触发频率官方预计也会比Fable 5低85%。逻辑很直白:能力弱一档的模型,看管自然可以松一点。

当然,护栏没有完全拆掉。网络安全类任务还是管得最严的:Opus 5不能直接扫描软件二进制文件找漏洞,但可以在源代码里找——因为后者更可能是防守方在做安全审计,前者更像攻击者的操作。这条线画得挺讲究。

触发护栏不再报错,自动降级接着干

前一天还有安全研究员集体吐槽AI护栏碍事,这次Anthropic顺手给了个补救方案:一个叫Automatic Fallbacks的测试版功能。开启之后,一旦请求触发了安全分类器,系统不再甩一个错误信息给你,而是自动把请求转给一个能力弱一些的模型去处理,API用户至少能拿到一个能用的结果。

  • Opus 5比Fable 5小、便宜、限制少,多项基准反而领先
  • 不受30天数据留存政策约束,安全分类器触发预计少85%
  • 二进制漏洞扫描仍被禁止,源代码找漏洞放行
  • 新功能Automatic Fallbacks:触发护栏时自动降级到弱模型,不再直接报错

这一手其实值得同行学:护栏要有,但别让守规矩的用户跟着受罪。旗舰模型管严点,次旗舰放宽点,再配一个自动降级兜底,体验和安全都照顾到了。至于Opus 5跑分反超Fable 5这件事,多少有点尴尬——花更多钱买旗舰的用户,怕是要重新算算账了。

0 点赞
0 收藏
分享
2 讨论
反馈
2 讨论
热门最新
总结
暂无总结

跑分反超旗舰这事真有点微妙,那Fable 5的定价还站得住吗?我猜Anthropic内部也纠结过要不要把这些benchmark放出来。另外二进制不让扫、源码可以找漏洞这个区分,思路是对的,但攻击者拿到源码的场景也不少见吧。

自动降级这个设计挺聪明的,比直接甩个error给你强多了。以前用API最烦的就是请求被分类器拦下来还得自己写重试逻辑,现在等于官方帮你兜底了。就是不知道降级后换成哪个模型,输出质量差多少。

0 / 600