摘要
心智理论(ToM)指推断他人心理状态的能力,高阶 ToM 涉及考量他人也拥有 ToM。虽然赋予 LLM 智能体 ToM 能力有助于多智能体协作,但研究发现 ToM 阶数错位会导致推理不足或过度,从而损害协调效果。为此,本文提出自适应 ToM(A-ToM)智能体,能根据历史交互估计伙伴的 ToM 阶数并据此预测其行为,实现阶数对齐。在四种多智能体协调任务中的实验验证了 ToM 对齐的重要性及 A-ToM 的有效性,并探讨了其泛化性。
AI 推荐理由
论文核心研究心智理论(ToM)推理阶数的对齐机制,属于高阶社会推理范畴。
研究机构
西北工业大学网络空间安全学院
上海人工智能实验室
华为诺亚方舟实验室
云南大学统计与数学学院
论文信息