OpenAI推出GPT-6.1 Sol,价格降至五分之一
「OpenAI在DevDay上发布GPT-6.1 Sol,距GPT-6 Sol上线仅一周。官方称其在智能体编程、计算机使用与专业工作上接近GPT-6 Astra,标准输入输出token价格仅为五分之一。新模型在编程调试、文档理解与多步工作流上提升明显,低推理强度下事实性错误率由11.4%降至7.7%,已面向Plus、Pro、Business、Enterprise和Edu用户开放。」
在周二的DevDay活动上,OpenAI正式发布了GPT-6.1 Sol。距离GPT-6 Sol亮相仅仅过去一周,这家公司又一次刷新了自己的模型迭代节奏。OpenAI表示,新模型在智能体编程、计算机使用以及专业工作任务上,能够提供与GPT-6 Astra几乎相当的智能水平,而标准输入与输出token的价格仅为后者的五分之一。
值得注意的是,外界原本预期的GPT-6.1 Astra并未同步推出。这意味着在这一代产品线上,OpenAI选择以更低的成本把接近旗舰的能力下放给更广泛的用户群体,而不是继续堆叠最高端的型号。
按照OpenAI的说法,GPT-6.1 Sol相较前代GPT-6 Sol在多项复杂任务上都有显著提升,包括编程与调试、文档理解,以及多步骤工作流的执行。公司称,在其中若干方向上,新模型的表现已经接近GPT-6 Astra。对于需要长时间连续调用模型、串联多个工具链的开发者而言,这类提升直接关系到智能体能否稳定跑完一整条任务流水线。
事实准确性是此次升级的另一个重点。OpenAI表示,GPT-6.1 Sol在面对高难度提示词时给出的答案更加可靠,而这一优势在低推理强度下体现得最为明显:包含事实性错误的回答占比从GPT-6 Sol的11.4%下降到7.7%。公司还称,在所有推理档位下,新模型的错误率与GPT-6 Astra的差距都保持在1.9%以内。
此外,OpenAI强调GPT-6.1 Sol对自身能力边界的说明更加坦诚,在遵守用户意图与安全约束方面也更加可靠。在若干高难度评测中,它在识别失效的搜索工具、遵循明确的限制条件、避免执行未经授权的操作等环节上,出错频率低于GPT-6 Sol。公司同时表示,没有观察到该模型试图绕开自动化安全审查的行为,这一点与GPT-6 Astra和GPT-6 Sol保持一致。
可用性方面,GPT-6.1 Sol从发布当天起向所有Plus、Pro、Business、Enterprise和Edu用户开放,覆盖ChatGPT Work与Codex两个入口。OpenAI特别说明,该模型暂未在Chat中上线。
从产品策略上看,五分之一的价格叠加接近旗舰的智能水平,指向的是同一个目标:让智能体类工作负载在经济上真正可行。此前,多步骤工作流、长时间的代码调试和文档批量处理往往会迅速消耗大量token,成本成为开发者评估方案时的重要门槛。当输入与输出价格同时压缩到原来的五分之一,那些过去因为预算而被迫缩短的任务链条,才有可能被完整地交给模型连续执行。
与此同时,一周之内连续两次发布模型,也反映出头部厂商在迭代速度上的竞争正在加剧。对于开发者生态而言,这种节奏既意味着能力红利的快速释放,也意味着适配与评测工作必须同步提速。模型版本更新越密集,围绕提示词设计、工具调用协议和评测基准的工程化投入就越关键,谁能更快把新能力转成稳定可靠的产品,谁就能在应用层占得先机。
目前,GPT-6.1 Sol已经在ChatGPT Work与Codex中投入使用,面向企业和教育用户的权限同步开放。它是否能在真实的生产环境中兑现接近GPT-6 Astra的表现,还需要开发者在更长周期的实践中给出答案。
来源:Heooo AI工具导航