摘要
AI 助手需结合用户历史交互解读其当前情感状态,但现有数据集多关注瞬时情感或事实回忆,缺乏对此能力的评估。本文提出 A-MBER 基准,专注于基于多轮会话记忆的当前情感解读。该基准要求模型推断用户情感、检索历史证据并给出合理解释,涵盖判断、检索和解释任务。实验表明,A-MBER 能有效区分模型在长程隐式情感及高依赖记忆层面的表现,证明记忆机制通过选择性利用历史信息支持情感解读。
AI 推荐理由
论文提出情感记忆基准,核心评估利用长期交互历史进行情感解读的能力。
研究机构
Shanghai Shanmo Shongyang Technology Co., Ltd.
Third-level Manager of the Science and Technology Innovation Department, China Mobile Communications Group Liaoning Co., Ltd.
论文信息