Claude省Token的6个实战技巧:长对话不爆额
基于Claude Code实测,从精简系统提示到压缩对话,6个方法让长对话不爆token。
一、精简 CLAUDE.md,别让它超过 5000 tokens
Claude Code 会读取项目根目录的 CLAUDE.md 作为系统提示。这个文件越大,你真正能用的上下文就越少。有用户实测发现,超过 5000 tokens 的 CLAUDE.md 显著压缩了有效工作空间(来源1)。因此,把 CLAUDE.md 控制在必要范围内:只写核心规则(如代码风格、项目架构),不要放冗长的说明或示例。注意,嵌套在子目录中的 CLAUDE.md 文件不会在会话启动时自动重新注入,而是当 Claude 读取该子目录下的文件时才会重新加载(来源1)。这意味着如果项目有很多子目录,每个子目录都可能触发 CLAUDE.md 的加载,堆叠起来会很快消耗 token。因此,在根目录集中管理核心规则,子目录中尽量不放 CLAUDE.md,或只放该子目录特有的少量指导。
二、用子目录组织项目文件,避免一次性加载所有上下文
Claude Code 默认会扫描项目文件并填入上下文。如果所有文件都塞在根目录,一次会话就可能把 token 吃光。按照功能或模块把文件分到不同子目录,Claude Code 在任务中只加载相关子目录下的上下文。例如,把测试文件放在 tests/,源文件放在 src/,这样当你在 src/ 内操作时,不会自动带上 tests/ 的文件。原理是子目录文件会堆叠(来源1),但我们反过来利用它——只让必要子目录进入对话。
三、使用 .claudeignore 排除不需要的文件
和 .gitignore 类似,在项目根目录创建 .claudeignore,把不需要参与对话的文件(如 node_modules、dist、大型日志)写进去。这样 Claude Code 就不会扫描这些文件,从而节省大量 token。这个技巧来自社区实践(来源2),简单有效。
四、定期使用 /compact 命令压缩对话
当上下文占用达到 40%–50% 时,输入 /compact 命令。Claude Code 会自动把整个对话历史总结成一个压缩版本,释放 token 空间。这个过程不会丢失关键信息,但能让你继续延续话题而不爆额。建议把这个命令养成习惯,比如每完成一个子任务就压缩一次(来源2、3)。
五、分割任务到多个独立会话
一个长对话里塞太多任务,即使有 /compact 也会让上下文越来越混乱。更好的做法是:把大任务拆成多个小任务,每个任务开一个新会话。新会话只有最精简的配置和历史,token 利用率最高。比如,先对话完成“设计数据库结构”,再开新会话“实现 API 接口”。中间通过文件或笔记传递成果(来源2)。
六、减少冗余,保持提示简洁
每次提问时,避免重复描述背景、重复上一轮已经提过的信息。Claude Code 已经记住了上下文,你只需说当前需要它做的事。例如,不需要说“基于之前的代码,继续写第 3 个函数”,直接说“写第 3 个函数”。减少冗余 token 是省 token 最基础的原则(来源2)。
> 截至 2026 年 7 月,以上技巧均来自 Claude Code 用户的实测分享。如果你使用的是普通 Claude 对话,压缩命令和精简提示的原理同样适用。