摘要
针对 AI 代理通过模型上下文协议(MCP)调用外部工具时存在的安全隐患,本文提出 Governed MCP。这是一种驻留内核的工具治理网关,基于 Logit 安全原语构建。该网关在六层流水线中拦截每次工具调用,涵盖模式验证、信任分级、速率限制及语义检查等。实验表明,移除核心的 ProbeLogits 层将导致安全性能显著下降,且该架构能从根本上防止用户态脚本绕过安全限制,实现了完整的中介控制。
AI 推荐理由
论文核心研究 Agent 调用外部工具(MCP)的安全治理机制,直接关乎技能执行的安全性。
研究机构
Independent Researcher
论文信息