- ✓
每月 200,000 次请求
- ✓
10 个工作区
- ✓
60 天请求保留期
Tokenwise
一款可显示您过度支付情况的智能LLM代理服务
Tokenwise 是什么?
Tokenwise 是一款为创客和小团队设计的一行式LLM代理(兼容OpenAI的baseURL)。它能从您的真实请求中学习,精确指出您正在超额付费的环节,并通过您自己的流量质量检验(而非公共基准测试)加以验证。只需一键即可应用优化方案,同时实时以实际美元金额验证节省成本。
产品详细介绍
一款可显示您过度支付情况的智能LLM代理服务
Tokenwise 是一款为创客和小团队设计的一行式LLM代理(兼容OpenAI的baseURL)。它能从您的真实请求中学习,精确指出您正在超额付费的环节,并通过您自己的流量质量检验(而非公共基准测试)加以验证。只需一键即可应用优化方案,同时实时以实际美元金额验证节省成本。
定价方案
有免费方案- ✓
每月 2,000,000 次请求(独立版的 10 倍)
- ✓
50 个工作区 · 4 个角色层级
- ✓
180 天请求保留期
创始人评论
大家好,我是泰奥。
我在全职数据工程工作之余开发了几个小型SaaS项目,每个项目到最后都开始依赖大语言模型。我的API账单每月悄悄上涨,说实话我根本说不清钱花在了哪里。不知道是哪个功能、上周修改的哪个提示词,还是我不假思索选择的哪个模型造成的。我就是充值完事,然后继续开发。
真正让我在意的是那些我根本看不到的开销。我工作时Claude Code整天运行,还有Cursor和Codex。在账单寄来之前,这些开销全都无处可查,而这部分恰恰是我最摸不清去向的开支。
我试过市面上现有的工具。一个感觉已经停止维护了,一个需要整套可观测性配置才能起步,还有一个只能在基于特定框架搭建的技术栈上运行。它们都不适合我这种只想知道钱花在哪、该怎么优化的人。
所以我开发了Tokenwise。你只需要添加一行代码,或者让你的编码代理指向它,不需要修改任何生产环境代码,就能看到所有调用详情:成本、延迟、token用量以及浪费在哪里。然后它会告诉你该砍哪些开销:这里换个更便宜的模型,那里加个缓存,还有臃肿的提示词需要修剪。每个优化都会先对照你自己的质量标准检查,所以你永远不用为了省钱牺牲输出质量。
开发过程中这个产品的理念变化很大。一开始我想做个仪表盘。后来我意识到没人需要再多一个仪表盘,用户想要的是直接给出答案:你这里每月烧了842美元,点一下就能修复。真正的价值在于基于你自身的流量实时计算出能省多少钱。
目前还处于早期阶段,我真心希望得到大家的真实反馈。告诉我缺了什么,什么地方让人困惑,哪些功能你永远不会用。现在这些对我来说比什么都有用。
谢谢大家来看我的产品。
创始团队
官网信息
对每一次大语言模型调用都提供生产级可见性:实时监控成本、延迟、错误和质量。然后在不影响质量的前提下削减 20–30% 的成本。