AI Pulse

AI代理太烧钱,近半数公司开始踩刹车

毕马威(KPMG)一项调查发现,近半数企业高管因为成本问题减少了 AI 代理的使用。一位在政府相关企业工作的人说,高层当初把 AI 当成“神奇生产力盒子”来推。现在他们发现,用得越多,花得越多。

问题出在 token 上。账单按 token 数算,代理完成一个任务要试错好几次,每次尝试都在消耗 token。有人抱怨,他的 Claude token 大概 80% 浪费在错误任务和死循环里。另一条评论把原因说清楚了:这轮缩减不是因为输出质量差,而是 token 成本不可预测。固定订阅费之外,多出一笔算不准的开销。token 经济学成了现实。

一些人和公司开始找替代方案。API 成本上升、订阅配额收紧之后,有人转用本地 35B 模型。结果发现,原先以为很难的任务,本地模型也跑得动。他说,如果订阅还像以前一样慷慨,token 不贵,他不会切换。他一直想让模型在本地运行,为了隐私和控制。这次,成本头一回成了理由。有人算过,本地 AI 跑一周,电费大概几美元。也有人提到,同事正在生产环境里实施本地推理。

另一种看法是,炒作泡沫可能在缩小,但技术没失败。公司开始要求 AI 代理证明投资回报率,而不是继续补贴开放式实验。赢家会是狭窄、可衡量的工作流,并且设有硬性成本限制,不是“无处不在的代理”。

从想法到投资回报的距离还很大。科技行业有一种规模幻觉,觉得自己比世界其他地方跑得快,但开发一个产品需要的时间并没有缩短。超大规模云服务商在方向上受挫,但不是今天。泡沫什么时候破,取决于 OpenAI 和 Anthropic 还能不能拿到新钱。如果资本市场决定无限期烧钱,泡沫可以一直不破。

阅读原文
📚 相关主题 商业行业动态

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新