尽管深蓝在 1997 年击败了国际象棋世界冠军加里·卡斯帕罗夫,AlphaGo 也在 2016 年战胜了围棋选手李·塞多尔,但经典策略游戏《Stratego》长期被视为人工智能难以攻克的堡垒。即便是拥有巨额预算的 DeepMind,此前也未能开发出能稳定击败顶尖人类玩家的机器。

这一局面已被打破。由卡内基梅隆大学、麻省理工学院、纽约大学和斯坦福大学组成的联合研究团队近期宣布,其开发的人工智能系统 Ataraxos 成功击败了 Pim Niemeijer——这位被公认为史上最优秀的《Stratego》玩家。值得注意的是,该系统的训练成本仅为几千美元,且仅使用了 16 个 GPU。
隐藏信息带来的挑战
《Stratego》的核心机制在于“不完全信息”。每位玩家拥有 40 枚代表不同军衔的棋子,胜利条件是捕获对手的军旗。虽然对手可以观察到棋子的位置,但无法知晓其具体身份。只有当两枚棋子发生碰撞时,身份才会揭示,等级较低的一方将被移除。这种机制使得《Stratego》类似于扑克牌游戏,而非完全信息的国际象棋或围棋。
纽约大学研究人员、该研究的共同作者尤金·维尼茨基 (Eugene Vinitsky) 指出,《Stratego》的独特性正是其难点所在,也是此次突破的关键背景。





