AI Pulse

AI 模型定价市场彻底疯了:最贵比最便宜贵两万倍

想看看整个市场上不同模型的实际价格到底是多少。数字出来之后还挺有意思的。

价格区间

平台上最便宜的输出是 Mistral Nemo,每百万 token 只要 0.03 美元。最贵的是 o1-pro,600 美元。我重新跑了两遍数据,因为这数字看起来像单位写错了。付费模型的中位数在 2 美元左右,所以大部分目录都贴着地板价,只有稀稀拉拉一小串挂在高高的天花板上。

各提供商均价(先说前提)

* OpenAI:47.63 美元
* Anthropic:44.79 美元
* Google:5.58 美元
* Mistral:3.68 美元
* Qwen:2.86 美元
* Meta:0.74 美元

先说前提,因为反正总会有人提:这些都只是各提供商目录上的均价,没有按实际用量加权。OpenAI 的数字被 o1-pro 拉得很高,我怀疑没人会大规模用这个模型。综合下来输入:输出 = 3:1,大致和我自己的用量差不多。

即便如此,Meta 的 0.74 美元对比 OpenAI 的 47.63 美元,也是 64 倍的差距。就我用模型做的事情(主要是写代码和总结)来说,我得不到任何 64 倍的收益。

推理模型真正坑你的是输出 token

输入和输出分开计费,而在思考型模型上,这个比例变得非常离谱。Qwen3 的思考版输入 0.20 美元/百万,输出 2.40 美元/百万,差了 12 倍。Gemini 2.5 Flash 是 8.3 倍。只发一个问题的话还好。但如果你的 agent 要循环三十次,每一步都在按输出价格付费,那就没那么美了。我有一次就收到过这样的账单,花了特别长时间才搞明白是怎么回事,久到我自己都不好意思。

19 个免费模型,有几个真能用

不是试用额度那种免费,是 API 上真的免费:

* NVIDIA Nemotron 3 Ultra,1M 上下文
* Google Gemma 4(26B 和 31B 版),多模态,支持视频,262K 上下文
* Poolside Laguna S 和 XS,262K
* gpt-oss-20b,131K(OpenAI 的模型,在免费名单上)

当然有限流。但拿来随便折腾,或者跑些低流量的东西,比以前强太多了。

上下文涨了 63 倍,价格基本没动

年份平均上下文平均成本/百万 token
202310.5K$22
2024140K$12
2025357K$21
2026662K$16

每 token 的价格三年基本持平。上下文涨了 63 倍。不管你对其他所有事怎么看,这一部分是真的。

现在感觉像两个完全不同的产品

一边是每百万 token 0.03 到 2 美元、带着大上下文窗口,Mistral、Meta、Qwen、DeepSeek 都在这一边。另一边是 30 到 600 美元,OpenAI 和 Anthropic 高高在上。它们的目标买家已经不是同一批人了。在底部,价格根本是你不需要想的事;在顶部,你付钱是因为输出质量能推动业务里的某个数字。

数据来自 8 月 16 日的 OpenRouter API。

完整数据面板链接:https://app.vetros.dev/dash/eyJhbGciOiJIUzI1NiIsInR5cCI6IkpXVCJ9.eyJ0eXAiOiJzaGFyZSIsInBpZCI6IjEyMmZmNTk1IiwiZGFzaCI6ImRfODdmNDU3MzkiLCJ2ZXIiOjIsImlhdCI6MTc4NzA4NDc5MH0.V8uCPZtnzJ-djAXAv3HEmmZUHPkhO2NfhSgG2zGMYqw

―― 高赞评论(帖子共 4 条讨论)――

[+2] u/CallMePyro:Claude 味垃圾文。前提也太多了。还有“先说 X”和“直白地说”这种毛病。

[+1] u/Unhappy-Gur-237:输出 token 定价可能是这里面最有趣的部分。agent 执行一个任务要调用几十次,一个看起来每百万 token 很便宜的模型,实际花起钱来会快得吓人。

[+1] u/maizeq:AI;太长不看

阅读原文
📚 相关主题 行业分析

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新