Command Code优化缓存后,相同套餐额度提升近3倍
昨天博主发布了Command GOAT与OpenCode Go的额度对比后,Command Code的首席执行官亲自留言评论,指出博主少算了缓存相关的成本账。博主顺着这个线索研究后发现,Command Code确实有值得注意的优化设计。
编码智能体本身就是规模很大的前缀缓存(Prefix Cache)设备。单轮会话包含数十万词元(Token),进行下一轮交互时,真正新增的内容往往只有数千词元,系统提示词、工具信息、代码上下文和历史对话基本都不会发生变化。缓存命中率越高,这些已经存在的上下文成本就越低。
Command Code前段时间专门针对缓存颠簸(Cache Thrashing)做了一轮重点优化,采用了三项核心策略。
同一会话尽量固定分配到相同的GPU Pod,保持键值缓存(KV Cache)处于热状态;尽量维持稳定前缀,即便是服务提供商降级也不随意改动上下文;搭配工具调用修复机制,模型参数出错会直接在本地修正,减少模型来回报错重试的次数。
在v0.33.0版本的更新日志中,官方直接标注本次更新为「大型缓存重构」,中位数成本降低了2.9倍。目前官方称,产品的缓存命中率可以长期稳定维持在95%到99%之间。
同样的模型,同样定价10美元的套餐,缓存优化带来的成本差异累积起来,最终的可用额度会产生极大差别。