摘要
心智理论(ToM)使智能体能够推断他人的信念、目标与意图,这对以人为本的具身辅助至关重要。现有基准多评估离线问答或最终动作预测,未能充分测试具身智能体在动态环境中保持连接、更新特定主体信念、决定何时推理及仅在必要时干预的能力。基于 MindPower,本文提出 MindClaw 框架,将机器人中心的 ToM 推理扩展至实时闭环设置。该框架整合多源输入、信念记忆、具身认知触发技能、心智推理与动作生成,使智能体能在恰当时机输出有益行动而在无需干预时保持沉默。实验表明,MindClaw 在任务感知与干预校准上优于直接 VLM 基线,证明了触发技能优化对闭环具身 ToM 辅助的重要性。
AI 推荐理由
论文核心研究具身智能体的心智状态推理(ToM),构建闭环推理框架以实现精准干预。
研究机构
中国科学院自动化研究所
论文信息