新AI凭高效训练与实时规划击败顶级军棋玩家
近日,来自麻省理工学院、卡内基梅隆大学、纽约大学与斯坦福大学的联合研究团队在《自然》杂志发表成果,成功研发出名为Ataraxos的人工智能系统,在经典暗棋博弈游戏《战略棋》中全面超越顶尖人类选手。该研究由麻省理工学院Gabriele Farina教授指导,Samuel Sokota等人为主要作者。 针对《战略棋》等蕴含庞大隐藏信息空间的复杂决策难题,传统AI往往依赖高昂算力且难以突破人类水平。Ataraxos创新性地融合了自博弈强化学习与高效训练算法,大幅降低样本需求与计算成本。在实战中,系统通过生成式模型进行即时决策规划,动态推演对手棋子身份并评估后续路径,从而实现精准的风险计算与策略调整。测试数据显示,该模型训练所需自博弈局数不足前代先进系统的三十分之一,却在《战略棋》世界锦标赛中以39胜2负的成绩夺冠,并以15比1比4的绝对优势击败全球排名第一的人类选手。 研究团队指出,Ataraxos在汉塔牌、斗地主等多种非完全信息博弈中均展现出超人类表现,验证了其算法的广泛适应性。该系统有望未来被迁移至商业谈判、网络安全及军事推演等现实场景,辅助人类在信息不对称环境下制定战略。团队下一步将致力于提升模型的可解释性,确保AI决策具备人类可审计的透明度,为技术落地奠定基础。
此资讯由 AI 智能聚合生成,旨在高效传递行业动态,不代表任何观点或建议。
