摘要
针对多智能体系统中单一欺骗智能体可破坏整体协作且现有研究缺乏对自适应对手考量的问题,本文提出 GAMBIT 基准。该基准包含三种评估模式,利用国际象棋作为深度推理场景,引入基于高效进化框架的自适应欺骗智能体,其策略能与检测器协同进化。实验表明,零-shot 评估具有误导性,而重校准模式能有效衡量检测器对新型攻击的快速适应能力,为动态对抗环境下的防御提供了新视角。
AI 推荐理由
论文核心提出基于进化框架的自适应欺骗智能体,研究攻防协同进化机制。
研究机构
IDLab-T2K, Ghent University-imec
论文信息