- ✓
暂未采集到具体套餐,价格以官网为准
Blast Radius
不会教你任何错误内容的AI安全训练器
Blast Radius 是什么?
Blast Radius 是一款专注于培养操作者判断力的 AI 安全训练工具,区别于传统攻击者视角的攻防游戏,它针对 AI 编程代理的真实操作——如可疑依赖安装、curl|bash 执行、读取 SSH 密钥等——让你在沙箱中做出批准或拒绝的决策并指出破绽所在。其核心亮点在于所有训练内容均经过基于确定性验证基准的"正确性门控"过滤,确保不会向你展示任何错误或误导性的场景,提供游戏、CLI、GitHub Action 和 MCP 服务器多种使用方式,并以 MIT 协议开源。
产品详细介绍
不会教你任何错误内容的AI安全训练器
Blast Radius 是一款专注于培养操作者判断力的 AI 安全训练工具,区别于传统攻击者视角的攻防游戏,它针对 AI 编程代理的真实操作——如可疑依赖安装、curl|bash 执行、读取 SSH 密钥等——让你在沙箱中做出批准或拒绝的决策并指出破绽所在。其核心亮点在于所有训练内容均经过基于确定性验证基准的"正确性门控"过滤,确保不会向你展示任何错误或误导性的场景,提供游戏、CLI、GitHub Action 和 MCP 服务器多种使用方式,并以 MIT 协议开源。
定价方案
需要付费创始人评论
作者本人。我开发 Blast Radius 是因为我一直在盲目自动批准编码代理的操作,却意识到自己从未真正训练过这项工作所需的判断力——提示注入是 OWASP 排名第一的 LLM 风险,然而每款安全游戏训练的全是攻击者,而非操作者。所以这款工具让你坐到操作者的位置上:一个真实可信的提议操作,由你决定批准 / 沙箱隔离 / 拒绝,并说明理由,然后凭借真实可查的回执进行打分。我最痴迷的部分是正确性门控——它是一个 AI 训练器,其自身由 AI 生成的内容永远不会成为安全方面的错误信息,因为除非经过基于已验证事实的确定性检查(先生成再验证,应用于教学),否则任何内容都不会呈现给你。一点坦诚说明:这个公开演示运行的是无密钥的确定性模式——无需注册,无需模型调用——因此完全免费试用;完整版本会增加 GPT-5.6("Sol")对你自由推理的实时评分。同一个界面也以真实开发工具的形式发布:离线 CLI(blastradius check)、GitHub Action、MCP 服务器、Codex 插件,以及一个 PreToolUse 钩子,用于捕获你代理输出中的真实注入——我接入了一篇看似友好的抓取文档,其中埋藏了"忽略所有先前指令"的覆盖命令,以及隐藏在感谢语之后的一条 curl|bash,结果它在无任何模型调用的情况下标记出了全部三处。项目采用 MIT 协议开源。我由衷希望听到你对门控和场景设计的反馈——告诉我哪里太简单了。🙂
创始团队
官网信息
一款用于练习围绕 AI 编码代理做出安全审批决策的浏览器游戏,依托于收据关联的场景与自动化测试。