AI Pulse

Claude Opus 5.5更强了,每百万token从25美元降到20美元

Claude Opus 5.5更强了,每百万token从25美元降到20美元

Anthropic 周二发布了旗舰模型 Opus 5.5。公司说,它在编码和知识工作上的表现达到了新的最先进水平。距离上一代 Opus 5(7 月 24 日发布)只过了两个月。

Opus 是 Claude 三档里最强、也最贵的一档。Sonnet 居中,Haiku 最快最便宜。这次更新的看点是对比。在不少基准测试里,Opus 5.5 超过了体量更大的 Fable。它还完成了一些 Fable 没搞定的非正式任务。

性能更强,价格反而往下走。输出 token 的定价,从每百万个 25 美元降到 20 美元。其他指标也有类似下调。模型跑得更快,背后是服务它所需计算量的整体下降。对按量付费的团队和企业,这一步直接降低了使用门槛。

输出风格也变了。Opus 5.5 更少用术语,重要信息更靠前。以往要翻到末尾才能找到的结论,现在开头就有。

能力更强,安全边界没有放松。Anthropic 称,Opus 5.5 在生物学和网络安全能力上和 Mythos 相当。因此它受到的防护和 Fable 一样。这些防护会限制模型在某些任务上的使用。比如在编译程序里发现漏洞,或开发可识别的生物武器。安全训练和前代大致相似。对齐测试照旧,METR、Frontier Design 等外部机构也会做发布前评估。更先进的训练与评估系统已在为后续模型做准备,安全和监控系统也在改进之列。

这次发布,是 Amodei 表态要为前沿减速之后的第一个模型。本月初他在一篇文章里写道:“我越来越确信,充分解决风险需要更多的谨慎。不只是投资风险预防,还要调整能力进步的速度,让风险预防有时间跟上。”

接下来,Sonnet 5.5 和 Haiku 5.5 会在未来几周发布,性能改进类似。Anthropic 还表示,AI 变强后,公共政策更要在系统安全上出力。相关基础设施已经开始搭建,更多细节预计很快公布。

安全限制具体怎么执行、使用时会被挡住什么,官方还没细说。“最先进”目前是公司自己的说法。从产品面看,这次更新动了三个地方:能力、价格、限制。

阅读原文
📚 相关主题 产品发布

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新