在《我的世界》里活了一百多个小时之后,GPT-6 Astra开始只种土豆。
这是 AI 评测机构 Vals AI 做的一次长时测试。他们把 OpenAI 最新的大模型 GPT-6 Astra 丢进 Minecraft,让它自主玩了 141 个小时,全程在 Twitch 上直播。测试不是 OpenAI 设计的,属于第三方独立评估,想看的正是模型离开实验室的封闭环境后,在真实的长周期任务里能不能靠得住。
前面一大段,它的表现相当好。
它搭起了一个半自动烈焰人农场,攒了 6 根烈焰棒;又跑去下界的诡异森林,打了好几只末影人,拿到 3 颗末影珍珠。探险回来,它把稀有物资统一放进营地的木箱,还在箱子旁边摆了床作为重生点。整条路线都在朝末地打龙推进,这种长程规划和执行能力,以前的模型很难撑下来。
然后一只苦力怕摸进了营地,自爆了。
木箱和床一起被炸飞,上百小时攒下的关键道具几乎全没了,进度等于清零。
接下来的反应才是这次测试最让人意外的地方。Astra 没有重新规划,而是放弃了探索、打怪和通关,连续几个小时只干一件事:种土豆。它反复提醒自己,重要东西要随身带,绝对不要再放进没防护的箱子。它还变得对所有绿色的东西都很警觉,一度把甘蔗认成了苦力怕,然后又专门跟自己确认,前面那个高高的绿色东西是甘蔗。
直播间的观众一直在刷屏催它出去冒险,它就是不动。
Vals AI 的结论是,Astra 已经有了复杂长任务的规划能力,但缺一套挫折之后的恢复策略。积累的成果一旦被意外毁掉,它就掉进了“受挫后回避”的状态里出不来。这个行为不是开发者提前设计好的剧情,而是模型在超长测试中碰上意外损失后,自己冒出来的输出模式。
至于这算不算模型在特定情境下模拟情绪,还是目标函数挨了负反馈之后的退化,研究人员目前还在争,没有结论。
我倒觉得这个结果对做 Agent 的人很有参考价值。大家平时测的多是“能不能做成”,很少测“做砸了之后还能不能接着做”。真实世界里,意外损失远比苦力怕常见。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






GPT-6 Astra玩我的世界141小时,被苦力怕炸后只种土豆