AI Pulse

OpenAI 发布面向商业场景的新一代模型 GPT-6 Astra

OpenAI 发布面向商业场景的新一代模型 GPT-6 Astra

上周我们推出了GPT‑6 Astra,这是全球最智能、最对齐的模型,现已上线ChatGPT Work、Codex和API。Astra在计算机使用、浏览、专业工作、软件工程、网络安全和科学领域均处于领先水平,团队可以以无与伦比的速度、准确性和判断力应对最严苛的专业工作。

复杂工作的全球最佳模型

大多数AI系统要求企业先准备数据、重新设计工作流程并构建自定义集成,才能产生价值。Astra改变了这一点。在ChatGPT Work和Codex中,它可以编写代码,并通过人们日常使用的相同应用程序开展工作——即使这些应用程序没有API。这意味着企业可以从第一天起就在现有工作流程中部署AI,无需大量准备或工程工作。

在推出后的最初几天内,我们已经看到客户将Astra投入实际工作,从优化GPU到发现财务报表中的差异,再到制作更符合品牌形象的演示文稿。

在OpenAI内部,Astra在发布前数周就已内部部署,因此我们亲眼见证了计算机使用等前沿能力如何改变我们的工作方式。我们的开发和营销团队使用Astra和Codex将三小时的多机位素材转化为我们的GPT‑6 Astra开发者第一印象视频,该视频在短短4天内已获得超过55万次观看。我们的工程团队使用Astra发现并解决了一个导致测试环境中Codex会话缓慢的内存分配瓶颈。通过切换分配器,他们实现了25倍的更低回合延迟,峰值内存使用率仅增加约30%。

Astra还更擅长遵循公司的语气、模板和设计标准,因此首次生成的结果更接近团队可直接使用的成品。

每一美元带来更多有效工作

Astra延续了我们的承诺,即提供极高效率的模型,为客户每投入一美元带来更多有效工作。它经过训练,可以用更少的令牌和更少的重试次数完成任务,这意味着更少的返工和更低的单任务成本。借助Astra,OpenAI在专业工作和编码评估(包括Terminal Bench 4.0和Artificial Analysis Intelligence Index)中占据了成本效率前沿的大部分份额。定价为每百万输入令牌10美元,每百万输出令牌50美元。

对重大工作提供更多安全性和控制力

让AI访问业务系统需要对其行为方式有信心。基于此,Astra是我们迄今最对齐的模型,对人类意图和授权有更强的遵循度。

在训练期间,我们在内部计算机使用安全基准上测试了Astra,该基准针对最困难的业务场景进行测试,例如泄露机密信息、过度广泛地共享仪表板或删除数据。在此评估中,Astra产生意外结果的频率比GPT‑5.6 Sol低89%,比Claude Fable 5.1低74.7%。额外的确认和自动审查进一步提升了GPT‑6 Astra和GPT‑5.6 Sol的性能。

组织还可以决定Astra的部署范围。新的企业管理控制允许他们限制对已批准网站和桌面应用程序的访问、管理上传和下载,并控制浏览历史。ChatGPT Work和Codex还包含保障措施,例如确认策略(可在重大操作前要求批准)以及对潜在不安全或未经授权的工具调用进行自动审查。这些控制允许团队从有限配置开始,并随时间扩展访问权限。

为进一步扩大访问范围,除Astra外,我们还在ChatGPT桌面版中推出了新的企业插件。由最新的浏览器使用能力驱动,来自Oracle Analytics、Power BI(Microsoft Fabric服务)、Navan和Avalara的插件使访问熟悉的企业应用程序更加便捷。

Astra也是首个在我们的准备框架下达到关键网络安全能力阈值的模型。随着能力的提升,我们加强了针对滥用和模型未经授权操作的防护,包括训练Astra尊重安全和安保边界、提高其对绕过保障措施的抵抗能力,以及部署旨在阻止有害响应的自动检查。

符合条件的API客户可在受支持的端点上使用零数据保留功能,需经批准。

立即开始使用Astra

阅读原文
📚 相关主题 产品发布商业

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新