技术进展

OpenAI Astra模型补齐空间推理短板

Heooo 09月06日20时01分 38 阅读

「OpenAI应用研究主管鲍尔表示,空间推理曾是人类大幅领先计算机的少数优势,如今Astra模型已补上差距。独立研究员测试显示Astra在空间推理评估中表现完美,认为大语言模型视觉问题彻底解决。OpenAI称其为全球最智能、对齐程度最高的模型。」

OpenAI应用研究主管鲍里斯·鲍尔近日在社交平台表示,空间推理曾是人类大幅领先计算机的少数优势之一,随着Astra模型的问世,这一差距已经不复存在。这一表态源于独立AI研究员@spicylemonade发布的一项评估测试,该研究员称Astra在空间推理评估中表现堪称完美,完全“吃透”了所有题目。

据该研究员介绍,在过去,所有大语言模型在他的测试题目中总是出错,而Astra的表现则彻底改变了这一局面。他认为大语言模型的视觉能力问题已经得到彻底解决,空间推理这一长期困扰AI模型的瓶颈被显著突破。这一结论引发了业内对模型能力边界的重新审视,尤其是对视觉语言模型在复杂空间任务中的可靠性关注。

据了解,Astra隶属于GPT-6系列,距离GPT-5模型系列推出约一年,距离OpenAI最近一次推出GPT-5.6升级约两个月。OpenAI将Astra定义为“全球最智能、对齐程度最高的模型”,并形容其为专业工作的一次跃迁。这一表述传递了模型在通用性和精准性上的双重提升,而非仅仅是参数规模的扩大。

从能力描述来看,Astra不仅能理解静态图像中的空间关系,还能执行多种电脑操作任务,包括填写表格、调整文档格式、安排预约以及操作软件。按照OpenAI官方的说法,任何能在电脑上完成的事情,Astra都能以极快的速度替用户完成。这意味着模型不再局限于对话或内容生成,而是进一步向智能体方向演进,具备直接操作数字环境的行动能力。

OpenAI总裁布罗克曼更是以“欢迎来到AGI时代”来评价这一进展。尽管这一表述带有强烈愿景色彩,但Astra在空间推理上的表现确实展示了模型从“理解”到“行动”的跨越式进步,也为未来更复杂的自动化任务提供了技术基础。

# 空间推理 # Astra # OpenAI

来源:Heooo AI工具导航