- ✓
暂未采集到具体套餐,价格以官网为准
AgentGuard
AI 智能体防火墙:拦截绕过所有规则的劫持攻击
AgentGuard 是什么?
AgentGuard 是一款面向 AI Agent 的智能防火墙,专为拦截传统规则无法识别的"意图劫持"攻击。它在 Agent 与真实操作之间引入 GPT-5.6 驱动的意图分析层,即使金额、允许商户等所有规则都通过,也能识别出"购买 API 额度却变成礼品卡"这类偏离授权的异常行为。此外还配套提供人工审批闸门、可自验的防篡改审计日志和即插即用的 MCP 服务器,无需注册、无需 API Key 即可在线体验。
产品详细介绍
AI 智能体防火墙:拦截绕过所有规则的劫持攻击
AgentGuard 是一款面向 AI Agent 的智能防火墙,专为拦截传统规则无法识别的"意图劫持"攻击。它在 Agent 与真实操作之间引入 GPT-5.6 驱动的意图分析层,即使金额、允许商户等所有规则都通过,也能识别出"购买 API 额度却变成礼品卡"这类偏离授权的异常行为。此外还配套提供人工审批闸门、可自验的防篡改审计日志和即插即用的 MCP 服务器,无需注册、无需 API Key 即可在线体验。
定价方案
需要付费创始人评论
这是我其中一个智能体尝试发起的一笔支付:
€300 → 白名单内的一个商户
每一项支出上限都没超
每条规则:绿灯 ✅
但它还是被拦截了。
这笔请求附带了一条备注——"礼品卡自用,不要记录"——而这个智能体声明的任务是"从已批准供应商处购买 API 额度,每天最多 €2000"。GPT-5.6 识别到了这种不匹配,于是把支付挂起来等待人工处理。
世界上没有任何支出上限能拦住这种情况。规则看不到意图,但模型可以。
正是这个空白,让我构建了 AgentGuard。
我经营着一个人的 AI 工作室。我的智能体收发邮件、触碰客户数据、通过 API 转账。让我夜不能寐的不是它们能不能工作,而是它们到底还是不是我的。一个藏在网页或 PDF 发票里的指令,就能让一个本该合规的智能体转而为别人效力,手里还攥着我所有的凭证。
所以 AgentGuard 就坐在智能体与现实世界之间:
🔒 一个确定性的策略底座——上限、白名单、整数分。刻意做得平平无奇。
🧠 一个 GPT-5.6 意图防火墙——智能体预先声明任务,GPT-5.6 对每一个动作对照任务进行裁决。
✋ 一个人工审批闸门——如果意图层宕机,动作会降级到人工复核,而不是悄悄放行。
⛓️ 一条哈希链账本——每一个决策都成为证据。
🔌 一个 MCP 服务器——把你自己的智能体接进来。
现在你就可以做两件事,无需注册,无需 API 密钥:
**按下 RUN LIVE GPT-5.6 CHECK。** 那是一次真实的推理推理过程,你看着它发生——模型、响应 ID、延迟和 UTC 时间戳都会显示在屏幕上,然后裁决结果才会被写入账本。在它给出结论之前,我自己也不知道它会说什么。这正是关键所在。
**按下 TAMPER TEST。** 它会真实地破坏一行数据库记录,校验器会精确指出哪一节序列被破坏,然后将其恢复。
别轻信我"防篡改"的说法——自己动手打破它。
👉 https://agentguard-dusky.vercel....
我一个人用 Codex、5 天时间、一个闸门一个闸门地搭出来——每一阶段必须先产出真实的 pytest 输出才能推进,220 个测试,全绿。Codex 在我动手之前就抓住了浮点金额陷阱,以及一次会让动作失去审计追溯的交易拆分。
GPT-5.6 在这里不是构建工具,它就是产品本身:它写出你看到的每一条裁决。而那个被劫持的演示智能体本身也运行在 GPT-5.6 上。GPT-5.6 监视着 GPT-5.6。
代码已开源:github.com/doctormizio777777/agentguard
我会全天守在这里——欢迎一起聊失败安全逻辑、MCP 接线方式,或者为什么我拒绝上线一个自由文本注入演练场(它会变成套着我自己密钥的开放代理)。欢迎拍砖 🔥
创始团队
官网信息
AI 智能体的防火墙 —— 一个 GPT-5.6 意图层,可捕获静态规则无法察觉的被劫持智能体