模型大降价,Claude 跟降,最高档推理模式却因过度思考而失败
价格先砍一半
GPT-6 Luna 的输入价格是每百万 token 0.1 美元,输出 0.5 美元。GPT-6 Sol 和 Luna 都是对应 GPT-5.6 版本的一半。上一代 Luna 还是 0.2 美元和 1.2 美元。
这个价格把 Luna 放进 OpenAI 史上最便宜模型清单。排在前面的只有两个。一个是 2025 年 4 月的 GPT-4.1 Nano,另一个是 8 月的 GPT-5 Nano。两者都比 Luna 弱得多。
而且 GPT-5.6 本来计划在 11 月涨价 25%。GPT-6 的定价等于直接砍在促销价的腰上。
降价不止在入门端。GPT-6 Sol 定在输入 2 美元、输出 10 美元。这个价正好是 GPT-5.6 Sol 的一半,后者的价格还是 4 美元和 20 美元。Grok 4.7 更直接,定价输入 2 美元、输出 6 美元,不到 GPT-5.6 Sol 的一半。它的输入跟 GPT-6 Sol 同价,输出也贴近。最尴尬的是 GPT-5.6 Terra,它和 GPT-6 Sol 同价,留着已经没有理由。
Anthropic 跟着降
Opus 的定价在 Anthropic 这边五代没动过。4.5、4.6、4.7、4.8、5,全是输入 5 美元、输出 25 美元。Opus 5.5 第一次降,降了 20%,到 4 美元和 20 美元。缓存读取价格降了 60%,对长 agent 对话影响很大。90% 以上的输入 token 按缓存价计费。
不过 Opus 5.5 的位置很快被挤掉。它新定的价格跟 GPT-5.6 Sol 一模一样,结果 OpenAI 转头把 Sol 砍了一半。
Anthropic 还改了沟通风格。Thariq Shihipar 说,Opus 5.5 是用户反馈的直接结果。它沟通清晰,每 token 成本比 Opus 5.0 低,智能水平则跟 Fable 5.1 相当。token 效率也高,各档推理力度都适用。它还被设计成在 Blender 上更好用。这些基本回应了用户对 Opus 风格的主要抱怨。
最高档推理模式,直接失败
价格之外,作者还做了一组对比测试:让每个模型渲染鹈鹕。对比图里放着 GPT-6 Luna、GPT-6 Sol 和 GPT-5.6 家族的鹈鹕。5.6 系列颜色更大胆鲜艳,6 系列素淡得多。GPT-6 Astra 在 max 设置下画出了整组里最好的鹈鹕。
Claude 在同样的设置上失败。Opus 5.5 开 max 思考级别,没有返回任何结果。它还在推演 SVG 时就耗尽了 128,000 token 的上限,Claude 系列都是这个数。再试一次,结果一样。两次失败每次花掉 2.56 美元、将近 20 分钟。
他由此怀疑 max 档实际没用。一个普通的 SVG 提示都能过度思考到崩溃,更复杂的任务很难放心交给它。对照是 Fable 5.1。同样的 max 设置下没有过度思考,直接给出了他在 Anthropic 模型里见过最好的鹈鹕。
下一轮冲击点在低端
目前价格战打到 10 美元/50 美元以下的层级。GPT-6 Astra 和 Claude Fable 5.1 都还守在 10/50,暂时没动。Anthropic 预告 Sonnet 5.5 和 Haiku 5.5 即将推出。现在的 Haiku 4.5 还是输入 1 美元、输出 5 美元,GPT-6 Luna 只要它的十分之一。低端市场很可能就是下一轮价格战的焦点。