排名 模型 得分
🥇
295
tulu-2-dpo-70b AllenAI/UW · AI2 ImpACT Low-risk
1221±31.0 251 - 301 377 N/A 1221.000 [1190.0, 1252.0] 50.00 · 不稳 AI2 ImpACT Low-risk

没有找到相关模型