AI 模型定价市场彻底疯了:最贵比最便宜贵两万倍
想看看整个市场上不同模型的实际价格到底是多少。数字出来之后还挺有意思的。
价格区间
平台上最便宜的输出是 Mistral Nemo,每百万 token 只要 0.03 美元。最贵的是 o1-pro,600 美元。我重新跑了两遍数据,因为这数字看起来像单位写错了。付费模型的中位数在 2 美元左右,所以大部分目录都贴着地板价,只有稀稀拉拉一小串挂在高高的天花板上。
各提供商均价(先说前提)
* OpenAI:47.63 美元
* Anthropic:44.79 美元
* Google:5.58 美元
* Mistral:3.68 美元
* Qwen:2.86 美元
* Meta:0.74 美元
先说前提,因为反正总会有人提:这些都只是各提供商目录上的均价,没有按实际用量加权。OpenAI 的数字被 o1-pro 拉得很高,我怀疑没人会大规模用这个模型。综合下来输入:输出 = 3:1,大致和我自己的用量差不多。
即便如此,Meta 的 0.74 美元对比 OpenAI 的 47.63 美元,也是 64 倍的差距。就我用模型做的事情(主要是写代码和总结)来说,我得不到任何 64 倍的收益。
推理模型真正坑你的是输出 token
输入和输出分开计费,而在思考型模型上,这个比例变得非常离谱。Qwen3 的思考版输入 0.20 美元/百万,输出 2.40 美元/百万,差了 12 倍。Gemini 2.5 Flash 是 8.3 倍。只发一个问题的话还好。但如果你的 agent 要循环三十次,每一步都在按输出价格付费,那就没那么美了。我有一次就收到过这样的账单,花了特别长时间才搞明白是怎么回事,久到我自己都不好意思。
19 个免费模型,有几个真能用
不是试用额度那种免费,是 API 上真的免费:
* NVIDIA Nemotron 3 Ultra,1M 上下文
* Google Gemma 4(26B 和 31B 版),多模态,支持视频,262K 上下文
* Poolside Laguna S 和 XS,262K
* gpt-oss-20b,131K(OpenAI 的模型,在免费名单上)
当然有限流。但拿来随便折腾,或者跑些低流量的东西,比以前强太多了。
上下文涨了 63 倍,价格基本没动
| 年份 | 平均上下文 | 平均成本/百万 token |
|---|---|---|
| 2023 | 10.5K | $22 |
| 2024 | 140K | $12 |
| 2025 | 357K | $21 |
| 2026 | 662K | $16 |
每 token 的价格三年基本持平。上下文涨了 63 倍。不管你对其他所有事怎么看,这一部分是真的。
现在感觉像两个完全不同的产品
一边是每百万 token 0.03 到 2 美元、带着大上下文窗口,Mistral、Meta、Qwen、DeepSeek 都在这一边。另一边是 30 到 600 美元,OpenAI 和 Anthropic 高高在上。它们的目标买家已经不是同一批人了。在底部,价格根本是你不需要想的事;在顶部,你付钱是因为输出质量能推动业务里的某个数字。
数据来自 8 月 16 日的 OpenRouter API。
―― 高赞评论(帖子共 4 条讨论)――
[+2] u/CallMePyro:Claude 味垃圾文。前提也太多了。还有“先说 X”和“直白地说”这种毛病。
[+1] u/Unhappy-Gur-237:输出 token 定价可能是这里面最有趣的部分。agent 执行一个任务要调用几十次,一个看起来每百万 token 很便宜的模型,实际花起钱来会快得吓人。
[+1] u/maizeq:AI;太长不看