persistent memory personalization context-awareness benchmark LLM safety
摘要

大语言模型日益利用持久化记忆存储用户偏好以支持跨交互个性化。然而,在受社会与制度规范约束的第三方沟通场景中,部分偏好并不适用。本文提出 BenchPreS 基准,评估基于记忆的用户偏好是否能在不同沟通情境中被恰当应用或抑制。通过误用率与恰当应用率两项指标发现,即便前沿模型也难以实现情境敏感的偏好应用。结果表明,当前模型倾向于将个性化偏好视为全局强制规则,而非依赖情境的规范性信号。

AI 推荐理由

论文核心研究持久化记忆中用户偏好的情境感知选择性应用机制。

研究机构
延世大学 LG AI 研究院
论文信息
作者 Sangyeon Yoon, Sunkyoung Kim, Hyesoo Hong, Wonje Jeung, Yongil Kim et al.
发布日期 2026-03-17
arXiv ID 2603.16557
相关性评分 9/10 (高度相关)