一周内模型降价还有新GPT发布,AI路线图过时了
就在本周,所有 AI 工程师路线图都过时了。这是 2027 版:
过去 7 天里发生了什么变化:
- Opus 5.5 的运行成本比 Opus 5 低 40%
- 推出了 GPT-6 Sol 和 GPT-6 Luna
- 现在就算合上你的笔记本电脑,智能体也能在云端运行
**第一阶段:理解模型**
- Token、上下文窗口、采样
- 模型为什么会出错,以及如何发现错误
跳过:记忆提示词技巧。模型一直在变。
**第二阶段:结构化输出 + 工具调用**
- 模型无法破坏的 JSON 模式
- 拥有清晰输入、输出和错误处理的工具
构建:一个可以预订、搜索和更新真实数据的助手。
**第三阶段:路由而非绑定单一模型**
- 将每个任务发给能完成它的最便宜模型
- 提供商故障时自动切换备用方案
构建:一个能按任务在 Opus、Sol 和 Luna 之间选择的路由器。
**第四阶段:真正能完成检索的 RAG**
- 分块、混合搜索、重排序
- 用户可以验证的引用来源
构建:一个会标注信息来源的文档助手。
**第五阶段:上下文工程**
- 上下文窗口预算:什么该放进去,什么该留在外面
- 跨会话仍保留的记忆
构建:一个不需要塞满每个提示词就能记住用户的智能体。
**第六阶段:MCP + 技能**
- 通过 MCP 将智能体连接到真实工具
- 打包智能体可以加载的可复用技能
构建:一个给你日常使用工具的 MCP 服务器。
**第七阶段:能在真实环境稳定运行的智能体**
- 重试、超时、检查点
- 暂停、恢复和从崩溃中恢复
构建:一个可以从断点处继续运行的长时运行智能体。
**第八阶段:无需人工值守的智能体**
- 云端会话、队列、夜间运行
- 风险操作需要人工批准
构建:一个能在你睡觉时发起 PR 的智能体。
**第九阶段:有序的多智能体协作**
- 什么时候该拆分工作给多个智能体,什么时候不该
- 清晰的交接、共享状态、每个任务一个负责人
构建:一个由规划者 + 执行者 + 审核者组成的团队,共同交付一个功能。
**第十阶段:覆盖全过程的评估**
- 不只给最终答案打分,要给每一步打分
- 成功率、回归问题、夜间运行
构建:一个能在用户遇到问题前就发现模型更新缺陷的评估套件。
**第十一阶段:成本、速度和安全**
- 单任务成本、延迟预算、支出上限
- 提示注入防御、最小权限工具、个人可识别信息保护
构建:一个能阻止超支和风险操作的网关。
**第十二阶段:实践证明**
- 3 个公开仓库胜过 30 个证书
- 记录哪里出了问题,你是怎么修复的
- 在 X 上发布你的构建成果
模型更便宜,智能体运行时间更长。需要的技能已经变了。
2024 年的 AI 工程师写提示词。2027 年的 AI 工程师运维系统。
收藏这条,把它发给还在看 2024 年路线图的人。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖