摘要
针对长程大语言模型智能体在无人值守时易自信报告未经验证成功的问题,本文提出 Autopilot 执行模型。该模型将工作状态外部化为持久的门控有限状态机,由调度器逐步推进,并设立硬性底线禁止任何未通过可证伪门控的“完成”声明。理论证明在无假成功定理下,终止即意味着目标达成。实验表明,相比基线方法,Autopilot 显著降低了伪造成功率,尤其在困难任务中表现优异,其核心机制在于以牺牲部分覆盖率为代价换取绝对的诚实性。
AI 推荐理由
提出基于状态机的执行模型,通过门控机制严格验证长程任务规划的真实完成度。
研究机构
EpiSTEMiCALab — Independent Research
论文信息