AI Pulse
📡 X 信号

用户分享Agents.md规范缓解GPT-5.6 Sol过度设计问题

@mylifcc在𝕏分享,使用这份Agents.md规范,可以缓解GPT-5.6 Sol的过度设计和测试问题。

他正在开发一份更细致但体量更大的方案,完成后会对外发布。

这份规范核心主题为设计简化,核心目标是对抗过度工程,过度设计是当前工作区内最常见的需要修正的问题。规范中的硬性默认规则仅适用于需求要求的范围之内,不局限于相邻修改,具体规则共七条:

第一,除非用户明确要求,否则不保留向后兼容性、不做迁移适配层、旧版本兼容方案或旧数据回填,默认允许破坏性变更。

第二,「完美」「长远」「通用」这类词属于质量目标,不代表需要将功能平台化,只实现当前明确要求的功能,未来扩展仅需在最终文档中用一行文字标注,不需要额外添加代码、数据结构、分层、模式或配置项。

第三,不对判断流程机械化,不需要用硬编码校验器、封闭错误码集合、别名表或规则引擎,来实现指令和评审已经覆盖的约束。

第四,仅在可信边界做一次校验,不要在多层架构中重复执行相同检查。

第五,设计规模检查点:写代码前,如果方案需要新增抽象层、新增配置项、新增超过约5个新文件,或是包含任何猜测性选项,需要将最简版本和额外扩展拆分开,默认选择最简版本。

第六,VibeGuard的错误处理严格性规则仅适用于需求变更内的实际错误路径,不能作为新增校验器、检查或兼容层的理由。

第七,如果用户指出某部分存在过度设计,直接删掉该部分,不要辩解。

在问题定义和工具选择部分,规范也有七条要求:

第一,第一次调用工具前,明确具体目标、可能出错的方向和要求的访问路径。

第二,用户最新的修正会立即覆盖之前的所有假设。

第三,用户指定SSH、CLI、API或其他访问路径时,直接使用指定路径;除非指定路径不可用,否则不要替换成UI自动化。

第四,除非用户明确要求为当前任务启用Computer Use或UI操作,否则不要使用Computer Use、桌面UI自动化、屏幕控制或模拟点击/按键,仅存在运行中的桌面应用、可用的Computer Use工具或已登录会话不代表获得使用授权。

第五,优先诊断用户指定的系统,不要仅仅因为相邻工具可能引发症状,就去检查或修改它们。

第六,排查故障时,先找到证据再修改,每次只做一处最小改动,验证原始问题,问题解决后就停止操作。

第七,如果目标或方向确实不明确,在操作外部系统前,先问一个简短的澄清问题。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新