摘要
代码智能体需兼具长程状态推理与严格工具协议遵循能力。针对指令模型与思维模型能力互补但错位的问题,本文提出 CRANE,一种无需训练的参数编辑方法。该方法将思维 - 指令差异视为候选推理编辑方向池,结合幅度阈值去噪、保守泰勒门控及渐进 sigmoid 投影技术,在保留工具使用规范的同时注入强推理能力。实验表明,CRANE 在多个基准测试中显著优于单一模型及其他合并策略,实现了推理增强与效率保持的双重目标。
AI 推荐理由
论文核心提出通过零空间编辑注入推理能力,解决代码智能体推理与工具使用的对齐问题。
研究机构
Rensselaer Polytechnic Institute
IBM Research
论文信息