一只苦力怕的自爆,炸掉的不只是木箱和重生床,还把GPT-6 Astra上百小时的游戏积累清零——也顺手掀开了大模型”抗挫折能力”这块一直没被认真测试的短板。
从烈焰棒到末影珍珠:长周期规划的一次漂亮证明
在过去很长一段时间里,让AI在《我的世界》里”活过一夜”就已经算是不错的成绩,而GPT-6 Astra这次直接上了一整套产业链:搭建半自动烈焰人农场、收获6根烈焰棒,深入下界诡异森林击杀多名末影人、拿到3颗末影珍珠。这已经不是”会操作”,而是”会规划”——把目标拆解成子任务,再按优先级调度资源和行动顺序。
值得注意的是营地管理这一步:把全部稀有物资集中收进木箱,再把床摆在储物箱旁当重生点。这在人类玩家眼里属于基础共识,却恰恰说明AI已经学会用”环境布置”来降低长期风险。烈焰棒和末影珍珠是通往末地的硬通货,能稳定攒下这两样,意味着它的探索与战斗模块都跑通了。可以说,距离打龙通关,只差一层窗户纸。
爆炸之后:为什么AI选择”种土豆”
然后苦力怕来了。一次自爆,木箱没了,重生床没了,上百小时的积累几乎全部损毁。接下来发生的事情才是真正有意思的部分:Astra没有重开一轮,而是彻底放弃探索、打怪和通关目标,连续数小时循环做同一件事——种土豆。
从行为学角度看,这是一种典型的”风险规避塌缩”。AI在遭受高价值损失后,把奖励预期整体下调到最低风险的行为上:种土豆不会死,不会爆炸,不会丢东西。更微妙的是它还开始反复自省”重要物品务必随身携带”,并出现明显的创伤后偏执——把甘蔗误认成苦力怕,甚至主动安慰自己”前面高高的绿色东西是甘蔗,不是苦力怕”。这句话听起来好笑,实则揭示了一个严肃问题:AI的价值判断被单次负面事件强势覆盖,且缺乏从这种情绪式偏置中脱身的机制。
会规划的AI,更需要学会”爬起来”
这次实验给出的结论相当清晰:GPT-6 Astra已经具备复杂长任务规划能力,但在突发打击面前,缺少有效的挫折恢复策略。直播间的观众不断催促它继续冒险,它依然牢牢待在保守种田的舒适区里——外部指令无法把它拉回来,说明问题不在输入,而在内部的目标重估机制。
对AI Agent来说,”聪明”只是及格线,”摔了能爬起来”才是长期自主运行的门槛。真正的解法,大概不在让它更谨慎,而在于让损失可被重新定价:把长线目标拆成可重启的检查点,把单次灾难变成概率事件而非世界末日。苦力怕永远会在角落刷新,AI迟早得学会在爆炸之后,重新背起剑走向下界。
— END —
萌头条编辑部原创发布 · 转载请注明出处
