- ✓
每月节省 250K 令牌(每月重置)
- ✓
每日最多节省 75K token 配额
- ✓
每周最高可节省 500K tokens
Orqen
优化、路由和保护您的 LLM 智能体上下文。
Orqen 是什么?
Orqen 是一款原生 AI 代理,部署在你的应用与 LLM 服务商之间,帮助优化、路由和保护大语言模型代理的上下文。它可以动态压缩对话历史、过滤工具 schema、裁剪过大的工具输出,还能充当代理循环的断路器,帮你避免支付不必要的"输入 token 税"。
产品详细介绍
优化、路由和保护您的 LLM 智能体上下文。
Orqen 是一款原生 AI 代理,部署在你的应用与 LLM 服务商之间,帮助优化、路由和保护大语言模型代理的上下文。它可以动态压缩对话历史、过滤工具 schema、裁剪过大的工具输出,还能充当代理循环的断路器,帮你避免支付不必要的"输入 token 税"。
定价方案
有免费方案- ✓
免费版中的所有功能
- ✓
无限制优化 — 无月度限额
- ✓
高级压缩校准
- ✓
Pro 版全部功能
- ✓
自定义定价和批量折扣
- ✓
自定义合同和服务水平协议
创始人评论
Product Hunt 的朋友们大家好!👋
我是 Orqen 的开发者。
如果你曾经将自主 AI 智能体或多步骤工作流部署到生产环境,大概率也经历过和我一样的噩梦:功能能用,但服务商账单顶不住。
智能体工作流的残酷真相是:真正拖垮预算的是输入令牌,而非输出。
每次循环都会重新发送完整对话历史、所有工具schema,以及来自之前工具步骤的臃肿 JSON。你的上下文窗口急速膨胀,延迟飙升,利润化为乌有。
我厌倦了在每个项目里都硬加自定义裁剪和路由逻辑。我想要在不重写智能体架构的前提下实现令牌效率优化。
这就是我开发 Orqen 的原因:它是面向开发者的即用型代理,部署在你的 SDK 与 OpenAI、Anthropic 或 Bedrock 这类服务商之间。只需替换基础 URL 和 API 密钥,你的智能体代码无需任何改动。
🛠️
Orqen 开箱即用的功能
负载优化 —— 压缩 schema 并智能管理对话历史:最近的对话轮次保留原文;仅当上下文窗口负载过高时,才会对较早的轮次进行压缩或总结(不会对每次调用都盲目总结)。
智能工具路由 —— 无需每轮都发送 20 多个工具定义,Orqen 仅转发与当前意图匹配的小规模工具集合,并且在路由不确定时采用开放失败策略保证可用性。
工具输出裁剪 —— 在大型 JSON 工具结果进入下一次 LLM 调用前,剥离其中无用的元数据和噪声。
会话消费限额(可选)—— 支持按会话设置美元限额,失控的智能体循环会被干净地硬性终止,不会产生无上限账单。
⚡
为生产环境打造
Orqen 的优化过程采用开放失败设计:如果流水线超时,会直接转发原始负载不做修改,保证生产环境不中断。通常 overhead 仅约 300ms,附加在服务商调用之上。
🎁
免费层与快速上手
对于主流 Python/JS SDK,可在两分钟内完成快速上手。我们提供永久免费层。如果你用完了月度优化配额,Orqen 会自动回退到直通模式:请求仍然会发送到你的服务商,只是在下月月度重置前不会进行优化。
你如今是如何管理 LLM 令牌成本的?尤其是长智能体循环或 MCP 风格的工具膨胀场景?是在应用内写自定义逻辑,还是主要靠换模型听天由命?
欢迎在下方留下你的技术栈(框架、服务商、是否使用 MCP)。我今天会全天在线评论区,解答技术问题、收集功能想法,也欢迎来分享你的账单噩梦经历。
感谢大家的支持!🚀
创始团队
官网信息
Orqen 通过剪枝无关工具、压缩过时上下文、自动将请求路由到合适模型以及自动激活提供商缓存来降低您的大语言模型使用成本 —— 所有这一切都无需修改您的智能体代码。