Hermes Agent新增OpenAI原生服务端上下文压缩功能
今日 Hermes Agent 小技巧: 🪽
如果你正在配合 Hermes 运行 GPT-5.6,你需要了解一个全新设置。Hermes 现在可以在长会话中使用 OpenAI 的原生 Responses API 服务端压缩。
开启方法:设置 compression: codex_responses_native: true
妙处在于:不用再等 Hermes 在本地压缩超大对话,OpenAI 可以先在服务端压缩较早的上下文。Hermes 会保存加密压缩检查点,在后续轮次中重放使用。
因此你能获得:
→ 更好的长会话上下文管理
→ 跨轮次的持久压缩
→ 更少不必要的对话冗余
→ Hermes 原有的本地压缩仍可作为后备方案
而且这个功能并不会盲目对所有提供商启用。它专门限定为通过直连 OpenAI API 或你的 ChatGPT Codex 订阅运行的 GPT-5.6 使用。OpenRouter、xAI、Copilot、本地模型等不会被强制推送这个配置让它们「自求多福」😂
这个功能昨天刚上线。如果你在用 Hermes 配合 GPT-5.6 进行长时间编码或 Agent 工作流,我绝对推荐你测试一下。🤘🏻
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖