技术进展

GPT-5.6 Sol超快模式发布,算力飙升14倍

Heooo 08月14日13时02分 26 阅读

「OpenAI正式推出GPT-5.6 Sol“超快”模式,依托Cerebras晶圆级引擎架构,实现最高每秒750 token的输出速度,较标准模式提速高达14倍,适用于金融研究、实时客服等高负载场景。」

近日,OpenAI正式发布了GPT-5.6 Sol“超快”模式,标志着大模型推理速度迈入全新阶段。该模式此前已于7月面向部分特定客户进行内部预览,如今全面开放访问评估。据官方披露,GPT-5.6 Sol在不更换为更小或性能较低模型的前提下,最高可实现每秒750个token的输出速度,相较标准模式提速最高达14倍。


这一显著性能提升的核心在于其底层硬件架构的革新——Cerebras的晶圆级引擎(Wafer Scale Engine)提供了关键支持。该架构内置高达44GB的片上静态随机存取存储器(SRAM),有效规避了传统GPU系统中常见的数据传输瓶颈,大幅提升了计算效率与响应速度。


在实际测试中,GPT-5.6 Sol的表现尤为亮眼。在被称为“人类终极考试”的综合评测中,该模型仅用约11个小时便完成了全部2500道题目的处理,展现出极强的持续高负载运算能力。这种能力使其特别适用于对响应速度和计算强度要求极高的应用场景,包括事件响应、金融研究、实时客户支持、编程辅助以及复杂科研任务等。


尽管性能优势显著,但受限于当前算力资源的稀缺性,OpenAI表示将不会全面开放该模式。取而代之的是,公司将根据客户的工作负载契合度及现有算力可用性,逐步评估并发放访问权限。此举旨在确保高价值、高需求的用户能够优先体验这一突破性技术,同时维持整体服务的稳定性与公平性。

# GPT-5.6 # OpenAI # 大模型加速

来源:Heooo AI工具导航