Tool Safety Kernel Security MCP Agent Governance
摘要

针对 AI 代理通过模型上下文协议(MCP)调用外部工具时存在的安全隐患,本文提出 Governed MCP。这是一种驻留内核的工具治理网关,基于 Logit 安全原语构建。该网关在六层流水线中拦截每次工具调用,涵盖模式验证、信任分级、速率限制及语义检查等。实验表明,移除核心的 ProbeLogits 层将导致安全性能显著下降,且该架构能从根本上防止用户态脚本绕过安全限制,实现了完整的中介控制。

AI 推荐理由

论文核心研究 Agent 调用外部工具(MCP)的安全治理机制,直接关乎技能执行的安全性。

研究机构
Independent Researcher
论文信息
作者 Daeyeon Son
发布日期 2026-04-18
arXiv ID 2604.16870
相关性评分 9/10 (高度相关)