20美元的AI编程订阅,配个开源工具就能让额度翻倍用
一位专业开发者分享了一套省token的组合。他在工作中用无限量的Claude Code,习惯同时跑多个子代理处理不同任务。在个人项目里,他用Codex的20美元订阅配Oh My Pi(OMP)。困难任务和大型功能请求交给GPT Luna(xhigh)或GPT Sol,每周用量只消耗约1%。他特别强调,最划算的组合是Codex订阅加OMP,不是Codex CLI。后来他转用工作用的Claude订阅配OMP,消耗了约20亿token。
OMP省token的关键,在于更激进地控制进入模型上下文的内容。编码代理消耗token,大头在持续增长的历史记录。文件内容、搜索、终端输出、工具调用、推理结果,这些内容被一遍遍发给模型。用户提示只占很小一部分。OMP只检索相关代码段,压缩工具结果,截断噪声输出。它用更精准的代码搜索和LSP工具定位所需内容。编辑也更精确,减少重读文件和修复失败补丁的轮次。
OMP不总是比Codex CLI省token。它的省token潜力来自让模型的工作上下文保持更小、更相关,减少工具调用和重试次数。
有用户说advisor功能是他最喜欢的特性。它额外跑一个代理,但配置好watchdog文件后,能防止主代理偏离轨道。这样反而省下大量token。另一个用户在做SaaS开发,用paseo和OMP当harness。他发现OMP配Claude模型比Claude Code更好。同一任务耗时更少,省50-80%的token,轮次也更少。这个数字来自单一用户报告,且针对Claude模型,不是普遍保证。还有人称OMP是目前最好的harness。
发帖者承认OMP存在一些批评,但整体体验满意。也有自称"vibe coder"的用户来问OMP是否对非专业开发者有用。他的最大痛点是token消耗太快。有人表示会去试试OMP。
评论区还聊到CLI和GUI工具的取舍。有人试过多种CLI和GUI工具,觉得GUI更美观、功能更丰富。但他也承认,CLI工具在token效率上天然更优。OMP属于后者。