AI Pulse

OpenAI发布Agents API:一次调用,生产级智能体自己跑完整条任务链

OpenAI发布Agents API:一次调用,生产级智能体自己跑完整条任务链

OpenAI 今天把 Agents API 放到了公开测试版,所有开发者都能用。通过单个 API 调用就能创建一个能直接投入生产的智能体。开发者只需指定任务、模型、工具和运行环境。

这个接口和常见的 AI 聊天工具不同。聊天 AI 回答完问题就结束,Agents API 创建的智能体能自己跑完一整条任务链。中间要调用工具、并行执行、链式处理多步操作。它由 Codex 背后的同一套执行框架(harness)和基础设施驱动。OpenAI 负责托管和维护这套框架。开发者需要决定智能体在哪里运行:OpenAI 管理的沙箱、自己的服务器,或者沙箱合作伙伴的环境。

任务太长是这类智能体常见的难题:上下文窗口有限,跑着跑着就满了。Agents API 的做法是自动压缩早期的上下文,把继续运行所需的信息保留下来,支撑长时间任务。复杂任务也能拆开。多智能体支持把任务分解成相互独立的部分,子智能体各自维护上下文、并行处理。

这两个设计都在压成本。工具搜索按需加载相关工具定义,减少 token 消耗,同时保留模型缓存。程序化工具调用允许并行执行,也能链接相关操作。过滤和合并都在代码里完成,只有相关结果带回上下文。费用方面,Agents API 本身没有额外收费,开发者只为智能体实际用掉的 token 和工具付费。每次模型发布,接口都会获得版本化的能力更新,执行框架也随之改进。

Agents API 由开源的 Codex 执行框架驱动,代码库公开可查。开发者能自己去翻它是怎么跑的。OpenAI 同时推出了托管沙箱,复用支撑 Codex 和 ChatGPT 的沙箱基础设施。沙箱可以配置自己的文件、包、技能和插件。已经接入的合作方包括 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop 和 Vercel。环境分两种:完全托管,或者部署在客户自己的虚拟私有云里。配置方面,CPU、GPU、内存、性能、冷启动和成本都有不同档位可选。

公开测试版期间,OpenAI 会根据反馈快速迭代,目标是推向全面可用。它没有说明测试版是否有速率限制、托管沙箱的具体价格,也没给出正式版的时间表。

阅读原文
📚 相关主题 OpenAIAPI

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新