Game Theory Nash Equilibrium Zero-shot Learning Multi-agent Systems
摘要

针对多智能体交互中难以稳定达成战略均衡的问题,本文提出无需事后训练,现成的推理型 AI 智能体即可在零样本下实现类纳什均衡行为。理论证明,具备基于观察形成信念并做出最佳响应能力的“合理推理”智能体,其行为路径将收敛于延续博弈的弱纳什均衡。研究进一步放宽了收益共同知识假设,允许私有随机收益存在。通过在五种博弈场景中的实证模拟,验证了智能体内在的推理模式能自发产生稳定的均衡行为,无需通用对齐程序。

AI 推荐理由

论文核心论证“合理推理”能力使 Agent 零样本达成纳什均衡,聚焦推理机制。

研究机构
华盛顿大学
论文信息
作者 Enoch Hyunwook Kang
发布日期 2026-03-19
arXiv ID 2603.18563
相关性评分 9/10 (高度相关)