OpenAI推超快模式 速度狂飙14倍
「OpenAI面向企业用户推出GPT-5.6Sol UltraFast超快模式预览,由Cerebras提供算力支持,运行速度最高达标准模式14倍,每秒可生成750个tokens。该模式采用申请审核制,专为实时语音、智能客服、金融研究等高频业务场景设计,未来将逐步扩大API调用范围。」
OpenAI近日正式面向企业用户推出了全新的GPT-5.6Sol UltraFast超快模式预览版。这一模式的最大亮点在于其颠覆性的性能提升——模型运行速度最高可达标准模式的14倍,每秒最多能够生成高达750个tokens。如此惊人的吞吐能力,意味着在处理大规模实时任务时,企业能够显著降低等待时间,大幅提升业务响应效率。
据透露,这一超快模式的核心技术支持来自知名AI算力厂商Cerebras。Cerebras在专用芯片和高速计算领域的深厚积累,为GPT-5.6Sol UltraFast模式提供了坚实的底层保障。不过,为了确保算力资源的合理分配和使用效率,目前该模式暂时采用申请审核制。有需求的企业用户需要向OpenAI提交具体的使用场景申请,官方将根据实际情况进行综合评估,决定是否批准使用权限。
在应用场景方面,OpenAI明确表示,超快模式并非面向所有常规工作负载,而是专门为那些对实时性有极高要求的业务场景量身打造。例如,实时语音交互领域需要极低的延迟才能实现自然流畅的对话体验;智能化客户支持系统需要在瞬间理解用户意图并提供准确答复;商务应用中高频的数据处理和分析同样受益于高速推理能力;此外,开发智能体(Agents)、金融深度研究以及前沿的安全研究等场景,也都能从这一模式下获得显著的效率提升。
随着预览阶段的逐步推进,Cerebras所提供的算力资源也将持续优化。OpenAI计划根据企业工作负载的实际反馈,逐步扩大超快模式的覆盖范围,让更多企业能够通过API接口顺畅调用这一极速AI能力。可以预见,在不久的将来,这种超高吞吐的推理模式将成为高实时性应用领域的重要基础设施,推动AI技术向更深、更广的产业场景渗透。
来源:Heooo AI工具导航