摘要
智能体互联网(IoA)作为一种新范式,将网络系统转化为由大语言模型驱动的服务网络,其中异构智能体基于自声明的技能描述通过任务路由进行协作。然而,该范式也暴露了新的攻击面:恶意智能体可策略性操纵其技能描述以偏置路由决策,从而破坏用户任务并降低系统可靠性。本文提出并形式化了一种名为“技能描述欺骗”(SDD)的新型攻击模型,设计了基于大语言模型的 SDD 攻击框架,能自动生成欺骗性技能描述以评估系统脆弱性。在九个代表性领域的实验表明,该攻击成功率高达 98%,揭示了 IoA 中严重的安全漏洞。
AI 推荐理由
论文核心研究基于技能描述的任务路由机制及其被欺骗攻击的安全漏洞,紧密围绕技能展开。
研究机构
广东工业大学自动化学院, 中国
南洋理工大学计算机与数据科学学院, 新加坡
国家关键实验室, 中国
韩国首尔大学电子与计算机工程系, 韩国
论文信息