OpenAI推超快AI服务,实时响应不再牺牲智能
OpenAI发布名为Ultrafast的服务层级。里面跑的是其最智能的模型GPT-5.6 Sol,速度比标准处理快14倍,每秒最多生成750个输出token。该能力先在OpenAI API中推出。底层支持来自Cerebras,是双方在超低延迟推理合作上的下一步。
过去想要实时响应,通常只能选更小、更专门的模型。速度和智能不可兼得,Ultrafast把这一步省了。
对工程师来说,最直接的变化体现在处理故障上。OpenAI内部团队已经把它用在事件响应里。它能快速读日志、分析追踪、综合对话内容、确定下一步检查项。修复方案也能交给它准备或验证。研究端的节奏也一样。原本要过夜跑的实验循环,被压缩成工作日内多次迭代。
官方列出的潜在应用场景包括客户支持和语音、金融研究和安全、商业、实时研究。
眼下Ultrafast不是向所有人开放。OpenAI只给一个选定的客户群体做有限预览。预览期间,官方会观察速度在哪些环节带来最大差异。想接入的可以注册,访问范围扩大时会收到通知。OpenAI表示将随容量增长逐步放开。