Generative Recommendation Chain-of-Thought Reasoning Ability
摘要

针对单靠物品令牌难以构建有效思维链(CoT)导致生成式推荐模型推理能力受限的问题,本文提出 OneReason。研究指出有效推理依赖于感知( grounding 物品语义)与认知(重组用户行为为潜在兴趣点)。该方法包含:预训练中的强物品感知、监督微调阶段的三级认知增强 CoT 格式,以及强化学习中“先专精后统一”的训练策略,显著提升了推荐系统的思维与推理能力。

AI 推荐理由

论文核心提出 OneReason,旨在解决生成式推荐中推理能力激活难题,构建 CoT 机制。

研究机构
OneRec
论文信息
作者 OneRec Team, Biao Yang, Boyang Ding, Chenglong Chu, Dunju Zang et al.
发布日期 2026-06-04
arXiv ID 2606.06260
相关性评分 9/10 (高度相关)