AI工具导航

axonpush

在 CI 中重放生产环境智能体故障,阻止合并。

axonpush 是什么?

axonpush 是一款面向 AI Agent 的回归测试工具,能把生产环境中已发生过的失败案例在每次代码改动时自动重放,覆盖模型调用、工具报错、检索超时等完整链路,并在回归出现时直接阻断合并。通过 CLI 与 GitHub Action 集成,它以退出码、JUnit 报告和 PR 评论的形式反馈结果,让 prompt、模型或任一 agent 步骤的变更在上线前即可被验证。

产品详细介绍

在 CI 中重放生产环境智能体故障,阻止合并。

axonpush 是一款面向 AI Agent 的回归测试工具,能把生产环境中已发生过的失败案例在每次代码改动时自动重放,覆盖模型调用、工具报错、检索超时等完整链路,并在回归出现时直接阻断合并。通过 CLI 与 GitHub Action 集成,它以退出码、JUnit 报告和 PR 评论的形式反馈结果,让 prompt、模型或任一 agent 步骤的变更在上线前即可被验证。

定价方案

需要付费
官网查看
定制方案
  • 暂未采集到具体套餐,价格以官网为准

创始人评论

Sayan Biswas
Sayan Biswas创始人

Product Hunt 的朋友们好,我是 Sayan,axonpush 是我一个人做出来的。注册已经开放,有免费档,也不用绑定信用卡,所以你可以直接上手折腾,不用问我。

这个产品的起因,是某天晚上我自己在调试我们的求职 Agent。它返回的结果不完整,没人知道为什么——没有崩溃、没有报错、没有告警。我们依赖的一个搜索服务商降级了,工具调用失败,而 Agent 做了 Agent 该做的事:继续往下走,然后产出了一个看起来挺像样的结果。

为了找到原因,我最后把整条生产流水线拉到了我的笔记本上,给每一个步骤都加了一行日志,直到那个缺口自己露出来。让我一直过不去的就是这件事:系统本身知道发生了什么,却没办法告诉我,最后注意到问题的只有用户。

所以我不再去想办法做更好的告警,而是先做了一条记录。后端的 HTTP span、数据库查询、Agent 的决策、模型调用、工具调用、日志——全部都是同一种结构,一个 trace ID,一套时钟。每个 span 都带上 commit 和 prompt 版本,于是像上面那种失败就变成了一条数据集样本,再变成下一次发布的一道关卡。

第一次,你会用几分钟就定位到问题。第二次,它压根不会发出去。

这第二句话就是整个产品,我花了挺久才看清楚。一开始我觉得 trace 查看器才是核心,其实不是。工程师不想要再多一个仪表盘,他们想要的是失败不再发生。Trace 是让这道检查值得信任的证据,而你真正买的是那道检查:axonpush-eval 跑在你自己流水线里,退出码为 1,写一份 JUnit 文件,在 PR 下面留一条评论。

我想跟那些 eval 工具掰扯的地方在于:它们只给模型调用打分。这个工具会重放整次请求,所以那个返回 402 的工具、那次空结果的检索、那条超时的查询,全都在评估范围内。到过我用户那里的那些失败,没有一个是在模型调用里。

三种接入方式,每种都只用花一个下午:

1. 把已有的 OpenTelemetry exporter 指到 axonpush

2. 替换一个 Sentry DSN

3. 跑一下 npx @axonpush/wizard,让你的 coding agent 把 SDK 接好

两天前我在一个生产环境的 Django 代码库里试了第三种,事件在三分半钟内就落地了,全程没管。但那只是一个代码库,也是我熟悉的那一个,所以请把它当作一个数据点,别当作承诺。

我现在的情况是:独自做了大概六个月,注册这周刚开,目前还没有外部客户。免费档之后,Pro 是每月 49 美元,发布关卡就在这里;Team 是 249 美元。如果你不希望我的云沾到你的数据,一行命令就可以装到你自己的 AWS 账号里。

今天我想从大家这里要到的不是注册。如果你在生产环境调试 Agent,在评论里告诉我你的技术栈,我会直说这个东西能不能罩得住。如果罩不住,我宁愿如实讲。

如果想先看看再碰任何东西:SDK、向导和 coding agent 技能包都是 MIT 协议,现在就能装,文档在 docs.axonpush.xyz 开源开放。

创始团队

Sayan Biswas
Sayan Biswas创始团队