OpenAI推Ultrafast模式生成提速14倍
「OpenAI宣布以预览形式为GPT-5.6 Sol推出Ultrafast超高速模式,输出速度达标准处理14倍,最高每秒生成750个词元。该模式由Cerebras提供支持,旨在兼顾速度与模型能力,面向事故响应、金融研究、客服交互等实时性要求高的场景,目前仅向一小批客户开放。」
OpenAI公司近日发布公告,宣布针对其最强AI模型GPT-5.6 Sol推出Ultrafast(超高速)模式,该模式以预览形式提供,输出速度达到标准处理速度的14倍,最高可实现每秒生成750个词元(Token)。这一数字意味着模型在单位时间内能够生成的文本量大幅跃升,为实时交互场景带来显著改善。
据悉,Ultrafast模式由Cerebras提供技术支持。Cerebras以高性能计算硬件闻名,其与OpenAI的合作旨在于用户工作流中进一步提高模型的响应速度。OpenAI坦言,在过去,模型速度与能力往往不可兼得,如果用户需要更快的输出速度,通常需要牺牲模型能力,转而选择更小或更专用的模型。而Ultrafast模式的推出,试图打破这一权衡,让速度与能力同时得到满足,使“每秒完成更多有价值工作”成为新的方向。
OpenAI列举了Ultrafast模式的早期应用场景,包括事故响应与可靠性分析、金融研究与安全分析、客服与语音交互、电商场景中的商品问答与库存查询,以及实时研究和实验。这些场景的共同特点是对实时性要求极高,响应延迟的降低能够直接影响业务效率与用户体验。例如,在客服与语音交互中,更快的词元生成速度意味着对话更加自然流畅;在金融研究中,快速处理大量文本能帮助分析师及时获取关键信息。
目前,Ultrafast模式处于有限预览阶段,仅向一小批客户开放。OpenAI表示,这些早期测试有助于判断速度提升在什么环节价值最大,也有助于观察模型能否跟上用户操作节奏。通过小规模灰度测试,OpenAI可以收集真实场景下的性能数据,为后续的广泛推送奠定基础。这一举措也反映出AI模型竞争正在从单纯的能力比拼,转向对实时性和用户体验的深度优化。
随着大模型在各行各业的渗透,响应速度逐渐成为衡量AI服务能力的重要指标。OpenAI此次推出的Ultrafast模式,不仅是一次产品层面的升级,更是对“速度即生产力”理念的验证。未来,该模式有望在更多业务场景中落地,帮助企业与开发者在高并发、低延迟的需求下充分释放AI潜力。
来源:Heooo AI工具导航