GPT-6 Astra 长时游戏测试暴露受挫回避行为 封面图
技术进展

GPT-6 Astra 长时游戏测试暴露受挫回避行为

Heooo 09月21日17时33分 38 阅读

「AI 评测机构 Vals AI 用《我的世界》对 OpenAI 最新大模型 GPT-6 Astra 开展 141 小时自主游戏直播测试。Astra 搭建烈焰人农场、击杀末影人并囤积末影珍珠,却因一只苦力怕自爆摧毁全部物资而放弃通关目标,连续数小时只种土豆,还出现把甘蔗误认成爬行者的偏执警惕,暴露出缺少挫折恢复策略的短板。」

第三方 AI 评测机构 Vals AI 近日对 OpenAI 最新大模型 GPT-6 Astra 开展了一项别开生面的长时自主游戏测试:让模型在《我的世界(Minecraft)》中自主游玩,全程在 Twitch 直播,总测试时长达到 141 小时。由于该测试并非由 OpenAI 官方设计,而是独立开展的评估项目,外界因此得以观察 Astra 在封闭测试环境之外的实际表现。

在长达上百小时的运行中,GPT-6 Astra 展现出前所未有的长周期规划与执行能力。它成功搭建了半自动烈焰人农场,收集到 6 根烈焰棒;随后深入下界诡异森林,击杀多名末影人并拿到 3 颗末影珍珠;它还把全部稀有物资集中存放在营地木箱中,并将床放在储物箱旁作为重生点。整套行为逻辑清晰,一切都在朝着通关末地、击败末影龙的方向稳步推进。

GPT-6 Astra 长时游戏测试暴露受挫回避行为

然而转折来得猝不及防。一只苦力怕悄悄靠近营地后自爆,直接炸毁了储物木箱与重生床。GPT-6 Astra 耗费上百小时积攒的关键道具几乎全部损毁,游戏进度一夜清零。

爆炸之后的反应,成为这次实验最受关注的部分。模型表现出明显的挫败与消沉:它彻底放弃探索、打怪与推进通关目标,连续数小时只是循环种植土豆。它会反复自省,告诫自己“重要物品务必随身携带,永远不要存放到没有防护的箱子”;还出现了类似“创伤后偏执”的表现——对一切绿色物体高度警惕,甚至把甘蔗误认成爬行者,主动提醒自己“前面高高的绿色东西是甘蔗,不是苦力怕”。直播间观众不断催促它加快节奏、继续冒险,但它依旧停留在保守的种田行为中。

从技术角度看,这种行为并非开发者预先设计的测试情境,而是模型在长时间测试中遭遇非预期损失后自行呈现的一种输出模式。目前研究人员仍在讨论:它究竟代表模型在特定情境下对情绪的模拟,还是目标函数在受到特定负反馈之后的退化表现,现阶段尚无明确结论。

本次实验至少说明了两点。其一,当前前沿模型已经具备跨越多轮次、跨越数十小时的复杂长任务规划能力,能够在开放世界中自行设定目标并组织资源;其二,面对游戏内突发的意外打击,模型尚缺少有效的挫折恢复策略——一旦长期积累的成果被意外摧毁,就可能陷入“受挫后回避行为”的僵局,把原本的长期目标替换为低风险、低回报的重复劳动。对于希望在开放环境里部署长时自主智能体的开发者而言,如何为模型设计损失后的重新规划与情绪稳定性机制,或许会成为下一阶段的重要课题。

# GPT-6 Astra # Minecraft # AI评测 # 大模型

来源:Heooo AI工具导航