- ✓
可以在你自己的电脑上运行的免费模型
- ✓
对 32 个可本地部署的大语言模型进行了基准测试
- ✓
评估了 25 个多轮情感高负荷场景
OpenGauntlet
找到你真正想要与之对话的本地 AI 模型
OpenGauntlet 是什么?
OpenGauntlet 是一个面向本地部署 AI 模型的评测对比平台,基于 Imprynt 长达一年的研究积累,对 32 种开源模型配置在对话真实感、情商、记忆、语音适配以及端侧运行速度等维度进行系统比较。除了可查阅模型的真实回复与评测方法论,平台还整理了 106 款语音转文字与 168 款文字转语音系统的来源清晰的调研数据,方便用户挑选真正适合自己的本地 AI 模型。
产品详细介绍
找到你真正想要与之对话的本地 AI 模型
OpenGauntlet 是一个面向本地部署 AI 模型的评测对比平台,基于 Imprynt 长达一年的研究积累,对 32 种开源模型配置在对话真实感、情商、记忆、语音适配以及端侧运行速度等维度进行系统比较。除了可查阅模型的真实回复与评测方法论,平台还整理了 106 款语音转文字与 168 款文字转语音系统的来源清晰的调研数据,方便用户挑选真正适合自己的本地 AI 模型。
定价方案
有免费方案创始人评论
{"translation":"OpenGauntlet 源于大约一年的研究,期间我正在开发 Imprynt——一款语音优先的陪伴应用。通用基准测试帮我理解了哪些模型能够解决问题,但不能告诉我哪些本地模型是我真正愿意花时间与之交谈的。我开始让每个模型进行相同的多轮对话,从评分量表的多维度与两两对比偏好两方面进行打分,并将回复公开发布,使结果可供检验而非仅凭信任。我通过 D3velop 公开分享这项研究,因为比起散落在各个项目文件中,公开似乎更有价值。"聆听"(Listening)和"声音"(Voices)部分为外部来源的调研而非内部基准测试,已单独标注。我尤其期待对评估设计的反馈,以及下一款要接受"考验"的模型的建议。"}
创始团队
官网信息
一个面向本地托管对话式与语音 AI 开发者的公共基准研究与评测平台,衡量哪些本地 LLM 对话时最像人类,并对文本转语音与语音转文本系统进行评估。