2026-07-02
博弈论中,通用算法有时胜过专用算法
MIT研究人员联合多所高校开展的一项研究发现,在不完全信息博弈场景中,通用的策略梯度算法(Policy Gradient Methods)表现优于传统专用博弈论算法。研究团队开发了一套基准测试工具,可在普通笔记本电脑上运...
MIT研究人员联合多所高校开展的一项研究发现,在不完全信息博弈场景中,通用的策略梯度算法(Policy Gradient Methods)表现优于传统专用博弈论算法。研究团队开发了一套基准测试工具,可在普通笔记本电脑上运...
MIT研究人员在2025年国际学习表征会议上发表论文,挑战了博弈论领域的长期假设。研究发现,在双人不完全信息零和博弈中,通用的策略梯度算法训练的神经网络,其表现优于专门的博弈论算法。研究团队还开发了一套基准测试工具,可在...
牛津大学教授迈克尔·沃尔德里奇从事人工智能研究逾30年,他认为AGI短期内难以实现,当前AI革命的核心技术早在80年代中期便已奠基。他批评硅谷主导了AI叙事,将其导向逐利方向,与学界初衷背道而驰。他借助博弈论分析AI军备...
MIT电气工程与计算机科学系助理教授加布里埃莱·法里纳,将博弈论与机器学习、优化及统计学相结合,专注于多智能体决策的理论与算法研究。他曾参与开发Meta AI系统Cicero,该系统能在需要联盟与谈判的游戏中击败人类玩家...
这是一个基于西洋双陆棋的数学策略问题。游戏中5个棋子从位置0开始,每轮掷两个骰子(结果为1或2)。若骰子点数不同需移动两个棋子,相同则可移动四个棋子。目标是避免产生孤立棋子的"污点"状态。简单策略的期望掷骰次数为1,挑战...