行业资讯

OpenAI与Cerebras推出极速模式 提速14倍

Heooo 08月14日10时01分 17 阅读

「OpenAI联合芯片厂商Cerebras推出Ultrafast模式,使GPT-5.6Sol响应速度提升14倍。该功能目前处于预览阶段,优先面向企业客户开放,能将大模型无缝部署于事件响应、客户服务、金融市场分析等对时延敏感的复杂工作流中,并在输出吞吐量上优于竞争对手。」

OpenAI日前联合芯片厂商Cerebras推出了全新的Ultrafast模式,该模式能够将GPT-5.6Sol的响应速度提升高达14倍。这一突破性进展打破了传统大模型在“模型能力”与“响应速度”之间长期存在的妥协关系,让前沿模型得以在更多实时性要求极高的场景中发挥价值。

据了解,Ultrafast模式目前处于预览阶段,优先向部分企业客户开放。随着后续算力的持续扩容,OpenAI计划逐步扩大这一功能的覆盖范围,让更多企业和开发者能够享受到低延迟、高吞吐的智能服务。此次合作也体现了大模型厂商与专用算力供应商之间协同创新的重要性,Cerebras在芯片架构和计算效率上的优势为模型加速提供了强有力的底层支撑。

在过去,实时交互类应用往往不得不选用参数规模较小、能力相对有限的模型,以期获得更快的响应速度。而Ultrafast模式的落地改变了这一局面,使得GPT-5.6Sol这样的大型语言模型能够无缝部署于事件响应、客户服务、金融市场分析以及电子商务等对延迟极度敏感的复杂工作流中。企业无需再牺牲模型智能水平来换取速度,这预示着大模型在产业端的应用边界将被大幅拓宽。

与竞争对手Anthropic旗下的Claude快速模式相比,OpenAI在输出吞吐量与执行效率上展现出更强优势。这种性能上的领先不仅关乎用户体验,更直接影响企业自动化流程的生产力和响应能力。在金融市场分析这类要求毫秒级决策的场景中,更快的推理速度意味着更及时的洞察和更高的交易质量;在客户服务领域,低延迟则能显著减少用户等待时间,提升满意度与转化率。

业内分析认为,Ultrafast模式的推出标志着前沿大模型正在加速从“高延迟离线推理”向“高吞吐实时交互”演进。这一技术趋势将重塑企业级AI的落地形态与生产力标准,未来那些能够同时兼顾模型能力与响应速度的平台,有望在商业竞争中占据更有利的位置。

# OpenAI # Cerebras # Ultrafast模式 # GPT-5.6Sol # 大模型加速

来源:Heooo AI工具导航