- ✓
暂未采集到具体套餐,价格以官网为准
Koreshield
AI 客服代理的安全性与证据
Koreshield 是什么?
Koreshield 是面向 AI 客服代理的安全防护平台,会在模型行动前对客户消息、检索文档和工具调用三类不可信输入进行统一筛查,主动拦截数据泄露、帮助文档中的隐藏指令注入、策略偏移以及不安全的代理行为。平台会完整记录每一次安全决策,开发者只需一次调用即可完成集成,帮助企业以最小成本为 AI 客服构建可审计、可追溯的安全防线。
产品详细介绍
AI 客服代理的安全性与证据
Koreshield 是面向 AI 客服代理的安全防护平台,会在模型行动前对客户消息、检索文档和工具调用三类不可信输入进行统一筛查,主动拦截数据泄露、帮助文档中的隐藏指令注入、策略偏移以及不安全的代理行为。平台会完整记录每一次安全决策,开发者只需一次调用即可完成集成,帮助企业以最小成本为 AI 客服构建可审计、可追溯的安全防线。
定价方案
需要付费创始人评论
今天我们正式发布 Koreshield。它位于你的 AI 客服代理与每一个大语言模型之间。
你的客服代理会与陌生人对话,并根据对方的话采取行动。在大多数团队中,没有任何机制在模型执行之前对输入进行检查。而我们做到了。
问题在于:客服代理会基于三类它无法信任的输入执行操作——客户消息、它检索到的文档,以及它打算发起的工具调用。我们的工作就是在它们成为可被信任的模型行为或应用执行之前,对这三者进行检查。
你现在可以立即试用两项功能:
AI 安全网关:在调用模型之前先发起一次请求——你的服务器将输入发送到 https://api.koreshield.com/v1/scan,并附带 X-API-Key 请求头,模型看到输入之前就能拿到决策结果。一套声明式策略统管所有请求,且同一套策略可同时适用于 OpenAI、Anthropic、Gemini 以及 OpenAI 兼容模型,即使各家供应商在流式输出和工具调用的规范化方式上各不相同。
工具调用治理:每一个拟发起的工具调用在执行前都会根据你的策略进行校验。被引导去做不该做之事的客服机器人将直接拒绝执行,无论是账号信息修改、订单变更,还是超出你设定的退款额度。
平台还包含:
- RAG 安全:检查机器人所读取的知识库,确保隐藏在帮助文档中的恶意指令能被及时发现。
- 每一个请求和每一次拦截都会被完整记录。记录与拦截同等重要。
关于产品定位,我们保持坦诚:
- 目前仅在请求层强制执行。响应层的检查已进入产品路线图。
- 我们并不声称已经解决了 AI 安全问题。这是一个全新领域,任何宣称自己已经做到的人不过是在兜售概念。
托管版提供免费试用(一次性 3 天试用,需提供支付卡)。文档请访问 docs.koreshield.ai,约两分钟即可获取 API Key。
如果你正在运营一个 AI 客服代理,不妨试着攻破它。如果你成功了,我们希望第一时间看到你的报告。