设计与威胁模型
为什么我在 AI 代理与服务器之间放置了一个代理
执行点的位置、三种失效模式,以及协议边界的能力范围。
项目 · AI 安全
面向 AI 代理工具调用的最小权限代理。
AgentGuard 位于 AI 代理与 MCP 服务器之间,在调用执行前检查请求,在结果返回代理前检查输出;代理与服务器都不需要修改。
针对文件路径与 shell 命令执行拒绝规则,并用主机允许列表约束网络访问。
扫描工具输出中具有指令形态的内容,命中后阻断整个结果。
在允许的工具输出进入代理上下文前,遮盖已知秘密格式。
将策略决策写入哈希链审计日志,使事后修改能够被检测。
AgentGuard 是协议层控制,而不是 MCP 服务器进程的沙箱;它不宣称能够捕获所有提示词注入措辞,并明确公开威胁模型的边界。
设计与威胁模型
执行点的位置、三种失效模式,以及协议边界的能力范围。
实现与取舍
整条消息阻断、确定性规则,以及由正式策略测试发现的一次漏报。