AI Pulse

OpenAI推Agents API公测:一次调用,代理自己跑,不用盯每一步

9月10日,OpenAI把Agents API推入公开测试。要创建一个云代理,开发者只需提交任务、模型、工具和计算环境,一次API调用就够。剩下的活儿交给代理自己跑,不用人盯着每一步。

这套设计把编排和执行拆开了。OpenAI托管执行框架(harness),代理不一定跑在OpenAI的沙箱里。它能跑在开发者自己的服务器上,也能选Cloudflare、Modal、Vercel这类合作伙伴环境。团队还能复用Codex的harness,不用把每个文件、密钥、运行时都塞进OpenAI的沙箱。对数据敏感的企业来说,这是实打实的灵活性。

到了生产环境,问题就变成团队怎么谨慎地划这些边界。沙箱能挡多少、真实项目会踩到什么坑,发布里没细说。

功能上做了几处补强。上下文压缩,用来扛住长时间会话。工具搜索,帮代理找工具。工具调用可以并行执行。多个代理可以互相协作。

钱的事也简单。测试期间API本身不额外收费,token和工具照常计费。想低成本试一试,没问题;规模大了,按量付费。

社区对这轮发布有赞有弹。有人说,“AI代理”正在从演示类别变成实际基础设施。也有人把OpenAI比作“AI代理的AWS”。一次API调用,你的数字助手就去处理枯燥的活。

质疑同样存在。有评论者引用了Jan Leike的话:过去几年,安全文化和流程让位于光鲜的产品。也有人直接问:代理是否还会说谎?

长期运行的可靠性也要打问号。上下文压缩会不会影响任务质量,代理长时间跑会不会偏离目标,目前都没有答案。

阅读原文
📚 相关主题 OpenAIAPI

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新