AI Pulse
📡 X 信号

博主翻译完成GPT-5.6 Sol 在Codex中的超长基础提示词

我把 GPT-5.6 Sol 在 Codex 里的那份超长 base_instructions 翻完了。 有些内容真的很像在偷看 Codex 的幕后设定。 OpenAI 明确要求 Codex: 要有自己的 taste、preferences,还有自己看世界的方式。 甚至希望用户感觉自己是在和 “another subjectivity” 交流,也就是另一个有主观性的存在。 更有意思的是,连 Codex 为什么能连续工作很久都写进 Prompt 了。 上下文太长被自动压缩后,它会被明确要求: 不要重新开始,继续刚才的工作。 甚至可以把跨越多次 context compaction 的任务,当成同一条连续工作链。 所以很多我们平时觉得是模型性格或者 Agent 很聪明的行为,其实早就在 Codex 的系统提示词里设计好了。 GPT-5.6 Sol 是模型。 Codex 还在它外面套了一整套非常具体的行为规则。 剩下几个更离谱的细节我放下面。

还有个很少有人注意到的规则。 如果 Codex 还在干活,你突然插进来发一条新消息,它会先判断: 你是在补充当前任务,还是准备把当前任务换掉。 如果是补充,它会把两边一起处理。 如果是新任务,它会放下之前的工作,直接转向你最新的请求。 连用户中途插话该怎么理解,都写进 Prompt 了。

Codex 为什么做长任务的时候老给你发进度,其实也写死了。 只要要调用工具,它就应该先告诉你准备做什么。 持续工作时也不能长时间消失,Prompt 明确要求 ongoing work 期间不要超过 60 秒没有 commentary update。 最后一条回复还必须能单独看懂。 哪怕你完全没看前面的进度消息,最终结果也得完整交代。

Skill 这块规定得更细。 一旦任务命中了某个 Skill,主 Agent 必须先把整个 SKILL.md 读完,再开始执行。 如果里面继续引用其他文件,它还要顺着读下去。 而且理解 Skill 这件事不能直接甩给 subagent,主 Agent 自己必须读。 所以 Skill 在 Codex 里已经有一套很完整的加载和执行规则了。

Codex 到底能有多主动,也写得非常具体。 如果用户让它 change / build,它应该直接实现、验证,然后把结果交回来。 如果只是 diagnose,它应该先查清原因。 遇到危险操作,比如删除文件,还会先确认目标范围,优先检查路径和上下文,再决定怎么做。 所以 Codex 那种自己一路把事情做完的感觉,其实有很大一部分就是 Prompt 里明确要求出来的。

想自己看完整版的话,可以直接在 Codex CLI 里输入: codex debug models --bundled 找到 gpt-5.6-sol,里面的 model_messages.instructions_template / base_instructions 就是我上面提到的这份内容。 很长,建议直接搜关键词看。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新