混合调用Claude多个模型能省一大笔钱
这个工作流配合 Claude 能帮你节省数千美元费用。同时运行 Opus 5.5、Sonnet 5.5、Haiku 5.5 和 Fable 5.1,别再把 Opus 的令牌花在不需要 Opus 的工作上了。
整个思路可以总结为一句话:Opus 做规划,Sonnet 做编辑,Haiku 做阅读,Fable 在决策点做评审。
各角色细分如下:
- Opus 5.5,高强度,负责制定计划并评审最终代码
- Sonnet 5.5,中等强度,是执行者:编辑文件、运行测试
- Haiku 5.5,低强度,分为探索者(搜索和读取代码库)和研究者(拉取文档)。这是第一个带强度设置的 Haiku
- Fable 5.1,通过 `/advisor fable` 启用。Opus 在决策点调用它,每次都会获得完整对话记录。
Opus 通常会在三个场景调用它:
→ 在敲定方案之前:这个方法对吗?
→ 相同错误再次出现时:我们是不是卡在这了?
→ 在标记任务完成之前:有没有遗漏什么?
为什么 Haiku 只做读取?Anthropic 的发布文章说,对于复杂智能体编码,Sonnet 5.5 和 Opus 5.5 仍然是更好的选择(Terminal-Bench 4.0:Haiku 5.5 得分 39.2%,Sonnet 5.5 得分 70.6%),而 Haiku 5.5 适合范围明确的子代理工作。所以它只做查找,不做编辑。
如果你仍在全程只用一个模型,那么只是检查一个文件是否存在,你就要为每百万输入令牌支付 4 美元。而 Haiku 5.5 只需要 0.1 美元。
把这段指令复制到 Claude Code 中👇
“按照这个结构重新搭建我的 Claude Code 设置:确认 Claude Code 版本为 v2.1.293 或更高,这样 haiku 别名会解析为 Haiku 5.5。如果版本不够,停止操作并告诉我需要运行 claude update。
查看 ~/.claude/agents 和 .claude/agents 中是否已经有覆盖探索者、工作者、研究者角色的子代理。只给缺失的角色创建新代理。
将探索者和研究者的模型设置为 haiku,强度设置为 low,不启用编辑和写入工具。将工作者的模型设置为 sonnet,强度设置为 medium。如果现有子代理被锁定到其他模型,保持原样,只列出它。
把探索者子代理命名为 Explore,这样它会覆盖内置的那个,否则内置探索者会运行在主模型上。
在 ~/.claude/settings.json 中,设置 advisorModel 为 fable,并在 modelSettings 下将 claude-opus-5-5 的 effortLevel 设置为 high。用户设置中的顶级 effortLevel 不适用于 Opus 5.5。
检查所有会禁用顾问的设置:CLAUDE_CODE_DISABLE_ADVISOR_TOOL、DISABLE_TELEMETRY,或任何会阻止功能标志获取的项。还要检查 CLAUDE_CODE_EFFORT_LEVEL(它会覆盖子代理的强度设置),以及 CLAUDE_CODE_SUBAGENT_MODEL_FORCE(它会让 Claude Code 忽略子代理的模型字段)。报告你发现的所有内容,先不要做任何修改。
在 ~/.claude/CLAUDE.md 中添加一行:制定重大方案前、同一错误出现两次时、以及标记长任务完成前,都要咨询顾问。
所有修改先以差异对比展示,在我同意之前不要改动任何内容。”
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖