摘要
针对工具使用智能体在开放环境中因工具组合引发的“权限清洗”安全问题,本文提出 ChainCaps 框架。该机制引入运行时规则,为每个值携带特定汇点的能力预算,并通过交集传播预算,确保值在工具链中只能保持或丧失权限,无法通过组合获取新权限。作为透明 MCP 代理,ChainCaps 无需修改智能体或工具服务器即可部署。实验表明,其在五个前沿模型上将攻击成功率从 25-68% 降至 0-4.8%,同时保持了极高的良性任务完成率。
AI 推荐理由
论文核心研究 Agent 工具组合时的安全机制,直接关乎技能(工具)的使用与管控。
研究机构
Independent Researcher, Seattle, WA, USA
论文信息