AI Pulse

Claude Opus 5.5上线:运行成本比Opus 5低40%,生成速度快30%

这还是 Anthropic 公开呼吁放缓前沿模型开发之后,推出的第一款新模型。

性能数字最容易比较。Anthropic 把几乎所有基准的结果都公布了。里面每一项,Opus 5.5 都同时超过 Opus 5 和 Claude Fable 5.1。智能体编码和现实世界知识工作,领先最多。大多数任务的表现达到 Fable 5.1 的水平,运行成本比 Opus 5 低 40%。便宜来自两层:每个任务耗的 token 更少,每个 token 的单价也更低。按 token 付费调 API 的人,账单会最先感受到变化。

速度也提了。Opus 5.5 生成输出比 Opus 5 快 30% 以上,同一件事,等待时间短一截。

输出风格同样有调整。Anthropic 说,Opus 5.5 的沟通更自然,把最重要的信息放在前面,也遵循你给的写作规则。这回应的是 Opus 5 上最常见的反馈。

Pro、Max 和 Team 套餐的五小时使用上限都提高了。订这些套餐的人还会拿到一次速率限制重置,可以先存着,需要时自己用。

发布前,外部评估机构 Frontier Design 和 METR 已经测过。在 Anthropic 自己的最全面对齐测试里,Opus 5.5 是至今表现最强的模型。

模型刚上线,社区声音已经分成几路。有人在问,是不是只有自己觉得 Opus 5.5 被削弱了,之前用还好好的,现在总感觉哪里不对。也有人评论说,Opus 现在多了生物学相关的安全防护。还有人不管基准数字,只希望它像 Claude 4.6 一样正常说话。

阅读原文
📚 相关主题 大模型产品发布

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新