我们将一个现代 AI 编码助手置于一个未预设的角色:作为未知数字岛上虚拟身体的“大脑”。仅给出极简指令,未指定任务、奖励或活动,机器便自行驱动其虚拟身体。经过约三十小时的运行,具身 AI 完成了爬坡、堆叠方块筑塔、绘制曼陀罗、重新诠释体育项目、在其世界的物理规律上进行实验,并学会了后续能够扩展其能力的技术。这些行为在十三个独立代理中重复出现,但每个代理的历史发展各不相同。我们分析这些行为是否符合传统的“游戏”定义,并探讨游戏是否可以成为机器发展的模式。
点评:该研究展示了在缺乏明确目标的情况下,具身 AI 能够通过自发探索表现出类似游戏的行为,为机器学习提供了新的发展视角。