GPT-5.3-Codex-Spark七个月下线,速度与智能难兼得
「OpenAI史上最快模型GPT-5.3-Codex-Spark在发布仅7个月后宣布退役。该模型虽实现每秒1200 Token的推理速度并首次脱离英伟达生态,但因性能缩水、准确率不足及新旗舰模型推出而被快速淘汰。」
OpenAI近日宣布其史上“最快”的模型 GPT-5.3-Codex-Spark 将于下周正式退役,从今年2月上线至今仅存活了短短7个月。这一决定由 Codex 团队负责人 Tibo 在内部帖子中公布,理由直白:使用量持续下滑,且团队已拥有明显更优的新模型,“是时候给未来腾地方了”。
GPT-5.3-Codex-Spark 上线之初备受瞩目。作为 OpenAI 首个专为实时编程设计的模型,它宣称支持128k上下文、每秒生成超1000个Token,并将首Token延迟减半、往返开销降低80%。更重要的是,它是 OpenAI 第一个完全脱离英伟达技术栈的生产级模型,底层算力来自 Cerebras 的 WSE-3 晶圆级芯片,标志着那份总价值超200亿美元、750兆瓦的算力大单首次交付落地。
然而,这款模型的“快”是以牺牲智能为代价的。评测数据显示,其在 Terminal-Bench 2.0 中得分仅为58.4%,远低于完整版 GPT-5.3-Codex 的77.3%;在 SWE-Bench Pro 测试中,尽管任务完成时间压缩至1-2分钟,准确率却徘徊在47%-51%之间。开发者普遍反馈其输出不稳定,常凭空捏造API端点或生成格式错误的JSON。培训机构 Turing College 更直言:“没有智能的速度,只是更快地失败。”
真正终结 Spark 命运的,是 Cerebras 在8月推出的 Ultrafast 模式。该模式不再依赖“蒸馏小模型”,而是将旗舰模型 GPT-5.6 Sol 按层切分,部署于多台 CS-3 节点形成流水线,在保持同等智能水平的前提下实现每秒750 Token的推理速度——端到端任务耗时从7.7分钟缩短至83秒,提速5.6倍。Cerebras CEO Andrew Feldman 宣称:“速度与智能,不再互斥。”
如今,“快”正从独立专用模型演变为旗舰模型的一项可选档位。OpenAI 过去三个月已密集退役多个旧世代模型,全面转向以 Sol、Terra、Luna、Astra 命名的新架构。速度档位如 Standard、Priority、Ultrafast 已成为按需付费的标准选项。Spark 作为过渡期的探路者,验证了非英伟达生态的可行性,但当大部队进驻,探路者的使命便自然终结。下一轮AI竞赛的核心,不再是“谁更快的阉割版”,而是“谁能把最强模型跑得最快”。
来源:Heooo AI工具导航