- ✓
监控、值班响应与升级
- ✓
AI 调查 + 事后剖析
- ✓
状态页面、服务水平目标与工作流
triage.events — the AI SRE for on-call
可基于您的数据定位根本原因的人工智能站点可靠性工程
triage.events — the AI SRE for on-call 是什么?
triage.events 是一款面向 on-call 运维的 AI SRE 工具,它能在系统出现故障时自动分析实时遥测数据,定位问题根源。它会按照真实升级策略通知对应负责人,全程使用用户自己的 AI 密钥以只读方式运行,是真正的告警工具而非聊天机器人,统一定价为每位用户每月 25 欧元。
产品详细介绍
可基于您的数据定位根本原因的人工智能站点可靠性工程
triage.events 是一款面向 on-call 运维的 AI SRE 工具,它能在系统出现故障时自动分析实时遥测数据,定位问题根源。它会按照真实升级策略通知对应负责人,全程使用用户自己的 AI 密钥以只读方式运行,是真正的告警工具而非聊天机器人,统一定价为每位用户每月 25 欧元。
定价方案
有免费方案- ✓
覆盖全生命周期的端到端事件管理
- ✓
围绕您的安全与采购需求构建
创始人评论
嘿 Product Hunt 👋 我是宇鑫。
在线值班工具只擅长一件事:叫醒你——还让你焦虑。警报发生后就全靠你自己了:你需要搜索日志、翻遍仪表盘、检查刚发布的部署,只想回答一个问题:到底是什么出问题了?
triage.events 是帮你完成这部分工作的 AI 站点可靠性工程师。警报触发的瞬间,它就会调查你的实时遥测数据——指标、日志、链路追踪、最近的部署——给出最可能的根本原因和推理过程,然后根据真实升级策略通知对应负责人。在事故间隙,Ask triage 功能支持你用直白的英语询问基础设施问题,比如「为什么结账流程这么慢?」,它同样会基于实时遥测数据给出答案。
我做这个产品有几个核心特点:
🔑 使用你自己的 AI 密钥运行。不强制使用我们的模型——你可以自带模型(OpenAI、Anthropic、Gemini,甚至本地模型都可以)。仅对你的遥测数据拥有只读权限。你的基础设施相关数据绝不会发送给我们。
📟 它是一个真正的告警通知工具。支持排班、升级、确认/解决、审计日志、Slack 集成。
💬 直接对话基础设施。Ask triage 按需回答生产环境问题,不用再在仪表盘里摸索。
💸 一口价,全功能包含。每位用户每月 25 欧元,没有按功能收费的附加项。
欢迎大家试用,体验看看,告诉我还缺什么功能——如果你正打算换掉 PagerDuty 或 Opsgenie,一定要试试。
👉 免费开始(14 天试用,无需信用卡):triage.events
另外我很好奇——你遇到过最糟糕的凌晨 2 点告警是什么情况?没人能帮你,只能自己处理的那种。
创始团队
官网信息
PagerDuty、Statuspage、Pingdom 的工作以及您的事后分析模板——设计为一个系统,而非四份订阅。涵盖从第一个警报到最终事后分析的所有环节。