OpenAI 拟扩大 Ultrafast API 开放范围
「据爆料,OpenAI Platform 与 API 文档中已出现 Ultrafast API 相关文档,预示其可能扩大开放范围。Responses API Playground 正测试 Standard、Fast、Ultrafast 三档速度,Ultrafast 搭载 GPT-5.6 Sol,输出最高每秒 750 个 Token,较 Standard 最高提升 14 倍,目前仅向部分客户开放。」
有开发者在 OpenAI Platform 与 API 文档中发现,Ultrafast API 的相关文档已经出现。X 平台博主 @imjustnewatai 爆料称,这一迹象表明 OpenAI 可能正准备扩大 Ultrafast API 的开放范围,让更多开发者能够用上这套以极致输出速度为目标的能力。
与此同时,OpenAI 正在为 Responses API Playground 准备全新的速度选项。用户可以在 Standard、Fast 和 Ultrafast 三种处理速度之间进行选择,目前该功能仍处于隐藏状态,尚未向所有用户展示。从产品设计的角度看,把速度做成一个可切换的档位,意味着开发者可以按具体场景在延迟、吞吐与成本之间做取舍,而不必让所有请求都走同一条通路。
Ultrafast 并非全新概念。OpenAI 此前已正式预览搭载 GPT-5.6 Sol 的 Ultrafast 模式,官方称其输出速度最高可达每秒 750 个 Token,相比 Standard 模式的推理速度最高可提升 14 倍。不过这一模式目前仍仅向部分客户开放,普通开发者还无法直接调用。按每秒 750 个 Token 粗略换算,一分钟的输出量约为 4.5 万个 Token,这样的吞吐对于需要连续生成大段代码、长文档或是驱动多轮 Agent 循环的工作流而言,意义相当明显。
从时间安排来看,Ultrafast 在 9 月 29 日的 DevDay 期间扩大开放范围并非不可能。OpenAI 已推出 GPT-6 系列模型,涵盖 GPT-6 Sol 和 GPT-6 Astra,上述新模型是否支持 Ultrafast 值得关注。不过目前还没有人确认,所有 GPT-6 系列模型是否会在发布时支持 Ultrafast。
值得注意的是,速度档位的引入往往会牵动一整套 API 体验的重构。对开发者来说,Standard 适合对成本敏感的批处理任务,Fast 适合常规的交互式应用,而 Ultrafast 则更贴近实时补全、语音对话、高频工具调用等对首字延迟与持续输出速率都极为苛刻的场景。三种速度并存,也让人对后续的配额与计费方式产生更多想象空间。
如果 Ultrafast 真的在 DevDay 前后扩大开放,它将与 GPT-6 系列模型的落地节奏形成呼应,构成模型能力与推理效率同步升级的组合。对于正在构建 AI 应用的开发者而言,这既是性能红利,也意味着需要在架构层面重新评估请求分级策略,把合适的速度档位分配给合适的任务。
来源:Heooo AI工具导航