Anthropic 发布指南,调优 Claude 功能成本降 4/5
Anthropic 刚发布了一份指南,介绍让 Claude 迭代调优一个 AI 功能,最终同样的工作成本降到了大约 1/5,准确率还更高。
你可以让 Claude Code 遵循这份指南,通过相同流程把任意功能接入你的产品中(这些功能都会调用 Claude API),只需要两条命令。整个过程分三步。
第一步:从提示词中删掉多余步骤和矛盾规则。
第二步:逐步降级到更便宜的模型,降低算力消耗,一次降一级。
第三步:补上缺失的规则。
每一步都会用一套从未见过的用例进行测试,任何会降低准确率的修改都会被回滚。最终准确率从 78.6% 提升到了 90.5%。
新的 Sonnet 5.5 在能力上接近 Opus 5.5,但更便宜、更快,所以如果你想用它,先按照同样的方法进行衡量。
把下面这个提示词发给 Claude Code 👇
“阅读这份指南:然后列出这个项目中所有调用 Claude API 的地方,估算哪一个成本最高,让我来选一个。使用 claude-api 技能中的 build-eval 为它构建一个测试集,在运行任何内容之前告诉我 API 费用大概是多少。在我批准测试用例和评分后,在新分支上运行 hillclimb。目标是保持准确率并降低成本。你可以尝试更低算力消耗和更便宜的模型,包括 Sonnet 5.5。报告需要说明三件事:
1. 每一步修改了什么,每次调用的准确率和成本有什么变化。
2. 哪些更便宜的配置出了错,错在了哪里。
3. 从提示词中删除了哪些句子,添加了哪些句子。
先把报告发给我看。在我确认之前不要合并任何内容。”
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖