AI Pulse

Opus 5.5发布:缓存读取降价60%,智能体长任务更划算

9 月 22 日,Anthropic 发布 Opus 5.5。每百万 tokens 输入价格从 5 美元降到 4 美元。输出价格从 25 美元降到 20 美元。

缓存读取价格从 0.50 美元降到 0.20 美元,降幅 60%。Anthropic 说,缓存读取是智能体场景的主要开销。这类任务里,AI 自动执行多步操作,反复读取同一批上下文。缓存越便宜,长任务越经济。官方称,典型工作负载的成本比 Opus 5 低约 40%。原因是每个任务消耗的 tokens 变少,输出速度提升 30% 以上。

内部测试里,把负载均衡软件 HAProxy 从 C 移植到 Rust。Opus 5.5 耗时 9.5 小时,Fable 5.1 耗时 12 小时。Opus 5.5 的成本低 51%。模型支持 1M 上下文窗口和 128K 输出。单个请求能处理更长的文档,不用手动分段。

在 Terminal-Bench 4.0 上,Opus 5.5 得分 66.4%。GPT-6 Astra 为 57.9%,Fable 5.1 为 55.8%。这只是单一基准测试的成绩,不等于全面领先。

这些数据都由 Anthropic 自己报告。实际工作负载里成本能否降四成、缓存降价省多少,还没有独立测试结果。订阅费或免费额度会不会跟着降,官方没有说明。

阅读原文
📚 相关主题 大语言模型商业

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新