摘要
长程 AI 智能体执行涉及数百步动作的复杂工作流,早期错误假设会导致不可逆后果。本文提出强制注入框架,在四个信息维度、三个基准测试及四种前沿模型中,量化评估澄清请求的最佳时机。研究发现澄清价值高度依赖缺失信息类型:目标澄清在执行 10% 后价值骤降,而输入澄清可维持至 50%。现有模型均未在实证最优窗口内发起询问。该研究为时序感知的澄清策略提供了定量基础与设计目标。
AI 推荐理由
研究长程代理在执行复杂工作流中的澄清时机策略,直接关乎任务规划与目标导向行为的优化。
研究机构
PricewaterhouseCoopers U.S.
论文信息