Chain-of-Thought Early Exit Reasoning Efficiency LLM Analysis
摘要

现代推理模型常在答案确定后仍继续生成长文本。研究发现,52%-88% 的思维链令牌是在答案可从部分前缀恢复后产生的,揭示了“检测 - 提取间隙”。早期前缀的自由延续可恢复正确答案,但强制提取却常失败。作者通过总变差界形式化该不匹配,并提出黑盒自适应早退机制(BAEE)。该方法利用自由延续进行检测与提取,截断 70%-78% 的串行生成,同时将准确率提升 1-5 个百分点,有效防止后承诺覆盖。

AI 推荐理由

论文深入分析思维链推理过程中的检测 - 提取间隙,提出优化推理效率与准确性的方法。

研究机构
The University of Chicago Imperial College London
论文信息
作者 Hanyang Wang, Mingxuan Zhu
发布日期 2026-04-08
arXiv ID 2604.06613
相关性评分 9/10 (高度相关)