AgentGuard 位于 AI 代理与 MCP 服务器之间,在调用执行前检查请求,在结果返回代理前检查输出;代理与服务器都不需要修改。

安全层

调用策略

针对文件路径与 shell 命令执行拒绝规则,并用主机允许列表约束网络访问。

注入阻断

扫描工具输出中具有指令形态的内容,命中后阻断整个结果。

秘密脱敏

在允许的工具输出进入代理上下文前,遮盖已知秘密格式。

可审计决策

将策略决策写入哈希链审计日志,使事后修改能够被检测。

AgentGuard 是协议层控制,而不是 MCP 服务器进程的沙箱;它不宣称能够捕获所有提示词注入措辞,并明确公开威胁模型的边界。

工程文章

全部文章