AI Pulse
📡 X 信号

Anthropic公开26分钟降低Claude Code代币成本教程

Anthropic公开26分钟降低Claude Code代币成本教程

【快讯】哇啊啊啊,Anthropic官方居然公开了一整段26分钟的视频,内容是「降低Claude Code token消耗的研讨会」😳

- 在一段长对话里连续做3项任务,相同工作量会消耗大约2倍的token。所以要在任务切换时用 /clear
- 按用途区分模型。Haiku=小型任务和基础工作,Sonnet=准确修改,Opus=找不到原因的bug,Fable=没人解决过的问题
- 今天不用的外部连接(MCP=连接Claude和外部服务的机制)要用 /mcp 关掉。待机也不是免费的
- 像gh、aws、gcloud这类普通命令,只在被调用时运行,所以一开始不要加载任何东西
- heavy 的调研工作交给做基础工作的AI处理。读取的内容完成后就丢弃,只返回报告

不只是大量调用token的用户,对每月上限无法预估的个人开发者来说,这个内容也非常值得一看👇

那么,看完之后觉得「我也该整理一下了」的人,接下来会遇到的问题是『我现在的token到底消耗在哪了?』
视频后半段就讲了如何统计消耗。在设置里把CLAUDE_CODE_ENABLE_TELEMETRY设为1添加后,会显示三个数据。
缓存生效的比例、每次交互发送的量、按用户和模型区分的成本。
可以直接看到像“只有某个人全用Opus”“只有某个人缓存占40%”这类分布不均匀的情况。

不过,比起看到数据之后再慌,先确定「该在哪些地方换成更便宜的模型」方案的人,最终效率更高。引用链接里放了一篇文章,从设计到运行把这套方案整理成了连贯的内容👇

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新