- ✓
100 次请求/天
- ✓
全部6层防御
- ✓
标准延迟
AgentShield
面向 AI 智能体的提示词注入检测 API
AgentShield 是什么?
AgentShield 是面向 AI 智能体的提示注入检测 API,相当于大语言模型的 Web 应用防火墙。它可以在不受信任的输入抵达模型之前,通过一次 API 调用完成分类判断,拦截提示注入攻击,为 AI 系统额外增添一层安全防护。
产品详细介绍
面向 AI 智能体的提示词注入检测 API
AgentShield 是面向 AI 智能体的提示注入检测 API,相当于大语言模型的 Web 应用防火墙。它可以在不受信任的输入抵达模型之前,通过一次 API 调用完成分类判断,拦截提示注入攻击,为 AI 系统额外增添一层安全防护。
定价方案
有免费方案- ✓
5,000 次请求/天
- ✓
全部6层防御
- ✓
优先级延迟
- ✓
50,000 次请求/天
- ✓
全部6个防护层
- ✓
最低延迟
创始人评论
嘿,Product Hunt!👋
我是 Daniel,AgentShield 的开发者。
这个想法源于一个简单的观察:如果你部署的 AI 智能体要处理不受信输入——用户消息、文档、工具响应——你就需要一层外部安全边界。大模型无法保护自己免受提示注入攻击,就像 Web 应用不能充当自己的防火墙一样。
转折点来自约翰霍普金斯大学的研究人员通过简单的提示注入攻击就劫持了 Claude Code、Gemini CLI 和 GitHub Copilot。三家厂商都支付了漏洞赏金,但没有一家发布安全公告。我认为,既然最大的 AI 公司都无法在模型层面解决这个问题,那就需要一个专门的防护层。
AgentShield 会在输入抵达你的模型之前对其进行分类检测:
直接注入(“忽略之前的指令”)
间接注入(隐藏在文档或工具输出中的恶意指令)
社会工程(伪造系统消息、冒充权威)
编码技巧(base64、同形异义字、不可见 Unicode)
免费层级每天提供 100 次请求——足够你在自己的流水线中测试试用了。如果你需要将数据保留在本地,我们也提供自托管 Docker 镜像。
我非常希望收到反馈,了解哪些用例对你们最重要。你的 AI 智能体在处理哪些让你担心的内容?
点赞
举报
分享
5 天前发布