NeFut Logo NeFut
EN 管理员登录

[AI学术] 突破性战略游戏规划的SAGA:场景感知与目标演化智能体

发布于:2026-07-19 22:00 最后更新:2026-07-22 01:02
#algorithm #AI #Machine Learning

摘要

长时间跨度的战略规划在复杂的策略游戏中需要协调紧密耦合的决策领域,包括技术、经济、外交和军事,跨越数百个回合且信息不完备。现有的基于LLM的智能体在此环境下面临三个挑战:

  1. 它们从原始坐标观察中获取的关系结构(如距离或威胁)非常有限。
  2. 它们将整个不断增长的游戏状态序列化到每一个提示中,并在单一输出中规划所有领域,导致上下文溢出,紧急领域挤压长期领域。
  3. 唯一的奖励是滞后的最终得分,这在游戏内部或跨游戏之间提供的进展信号微乎其微。

我们提出了SAGA,一个LLM多智能体框架,通过三种机制解决这些挑战:

在以策略游戏FreeCiv为基础的基准CivRealm上,SAGA在六种方法中达到了最高的平均最终得分,在基础设施方面获得了统计上最强的提升,并减少了27%的输出令牌。通过启用跨游戏演化,它在五场连续游戏中达到了最高得分。

博主点评: SAGA的提出不仅有效应对了复杂策略游戏中的长远规划问题,更通过多智能体的协作与反馈机制,展示了LLM在动态环境中的潜力与灵活性,值得关注其后续发展与应用。

原文链接: https://arxiv.org/abs/2606.29932

[h] 返回首页