跳到主要内容
Shengxing Zhang
项目文章关于
EN

文章

工程札记

来自构建和测试 AI 代理安全边界的长篇记录。

AGENTGUARD · 设计与威胁模型 · 阅读约 5 分钟

为什么我在 AI 代理与服务器之间放置了一个代理

为什么执行点位于 AI 代理与 MCP 服务器之间,以及不同失效模式为何需要独立控制。

AGENTGUARD · 实现与取舍 · 阅读约 5 分钟

基于规则的提示词注入检测:它能捕获什么,又付出了什么代价

为什么检测到注入后阻断整个结果、为什么 v1 使用确定性规则,以及测试发现了什么。

© 2026 Shengxing Zhang

兴趣 GitHub 邮箱