Emotion Recognition Long-term Memory Benchmark Agent Evaluation
摘要

AI 助手需结合用户历史交互解读其当前情感状态,但现有数据集多关注瞬时情感或事实回忆,缺乏对此能力的评估。本文提出 A-MBER 基准,专注于基于多轮会话记忆的当前情感解读。该基准要求模型推断用户情感、检索历史证据并给出合理解释,涵盖判断、检索和解释任务。实验表明,A-MBER 能有效区分模型在长程隐式情感及高依赖记忆层面的表现,证明记忆机制通过选择性利用历史信息支持情感解读。

AI 推荐理由

论文提出情感记忆基准,核心评估利用长期交互历史进行情感解读的能力。

研究机构
Shanghai Shanmo Shongyang Technology Co., Ltd. Third-level Manager of the Science and Technology Innovation Department, China Mobile Communications Group Liaoning Co., Ltd.
论文信息
作者 Deliang Wen, Ke Sun, Yu Wang
发布日期 2026-04-08
arXiv ID 2604.07017
相关性评分 9/10 (高度相关)