Agent Security Tool Use Graph Neural Networks Attack Detection
摘要

本文提出 MCPShield,一种针对模型上下文协议(MCP)工具调用流量的攻击检测框架。该方法将会话编码为图结构,利用句子嵌入丰富节点特征,并对比多种 GNN 与传统基线模型。研究发现:内容级特征对检测至关重要,仅靠元数据效果有限; naive 随机划分会高估性能;基于 SBERT 嵌入的树集成模型表现最优,优于神经架构且自监督预训练无显著优势。

AI 推荐理由

论文聚焦 LLM Agent 工具调用(技能执行)的安全检测,虽非技能学习本身,但紧密围绕工具使用机制。

研究机构
杜兹大学计算机工程系,杜兹,土耳其
论文信息
作者 Sultan Zavrak
发布日期 2026-05-11
arXiv ID 2605.11053
相关性评分 8/10 (高度相关)