摘要
大型语言模型在生成长篇连贯内容时面临严峻挑战,现有推理增强模型在开放域写作中常出现长度崩溃。本文归因于静态分层规划的局限性,并提出交错结构思维链(IS-CoT)框架。该框架将动态的“规划 - 写作 - 反思”循环嵌入生成过程,实现策略自适应与全局对齐。基于此构建的高质量数据集训练的 IS-Writer-8B 模型,在长文本基准测试中达到最先进水平,展现出卓越的长度合规性与连贯性。
AI 推荐理由
论文提出动态规划循环解决长文生成崩溃,核心贡献在于规划机制。
研究机构
1 Institute of Computer Science and Technology, Soochow University
2 Information Research Center of Military Science, PLA Academy of Military Science
论文信息