AI工具导航

Harfi

它只做你说的,而不是你想要的。

Harfi 是什么?

Harfi 是一款考验指令精度的提示词挑战工具:你不会写下答案本身,而是书写指引 AI 精准执行任务的指令。每轮挑战都附带严格的格式规范——例如限定字数、要求 JSON 输出、禁止使用某个字母——由解析器客观打分,措辞越简洁分数越高。它让你重新审视语言与意图之间那条微妙的缝隙。

产品详细介绍

它只做你说的,而不是你想要的。

Harfi 是一款考验指令精度的提示词挑战工具:你不会写下答案本身,而是书写指引 AI 精准执行任务的指令。每轮挑战都附带严格的格式规范——例如限定字数、要求 JSON 输出、禁止使用某个字母——由解析器客观打分,措辞越简洁分数越高。它让你重新审视语言与意图之间那条微妙的缝隙。

定价方案

需要付费
官网查看
定制方案
  • 暂未采集到具体套餐,价格以官网为准

创始人评论

Abdalla Emad
Abdalla Emad创始人

Harfi(حرفي)在阿拉伯语中意为"字面的、逐字的"。这个名字精准概括了它的核心:一款语言模型听从你的字面指令,而非揣测你的真实意图。

每一关都会给你一条规则,模型的回答必须严格满足:恰好三条要点、五十字以内、合法的 JSON 且不带代码块标记、或是一段描写日落的文字且不能出现字母 O。你从不需要亲自写下答案。你要做的是编写那条让模型产出答案的指令,用最少的尝试次数获胜。

这款产品整个立足于一个关键决定:不用语言模型来评判你的作品。其他所有 AI 学习工具都会让模型来判断你做得如何——同一个问题问两遍,就会得到两个不同的答案。而在这里,裁判是代码。它会清点要点数量、解析 JSON、扫描禁用字母、与已知正确答案进行差异比对。同一次尝试永远得到相同的评分,当你失败时,你会看到具体的字眼:59 > 50 → 不通过,而不是"不错的尝试,86/100"这种模糊评价。

评分方式采用类似高尔夫的击杆数对照标准杆制。标准杆 4 的关卡两杆完成就是小鸟球,一次完成就是一杆进洞。

40 关全部用真实模型进行了校准——每个关卡用两套提示词,各跑八次:一套是熟练玩家会写的(必须通过),一套只涉及主题(必须不通过)。从中得出的一些结论确实让我感到意外:

让模型自己计数反而会让结果更糟。被要求统计每项的字数后,它会把字数写进答案里,从而突破它本该遵守的字数限制。

字母禁用存在上限,而 E 已经超过了这一上限。四十字时通过率为零,十二字时仍然是零。O 和 A 会让模型失去它惯用的词,却不会让它丧失表达能力。

它不会压缩到低于自然长度之下。它会遵守高于它本会写出的字数的预算,却对低于此的预算悄悄忽略。

它不是随机数生成器。"在 1–100 中选一个数"→ 42、42、42。一致性测试正是建立在这个特性之上的。

第一组合计 8 关,永久免费,无需绑定银行卡。Plus 版本 7.99 美元/月或 59 美元/年,包含全部五组合计 40 关及 160 枚奖牌。

由我独立开发,使用了 Next.js、Claude Haiku 4.5、Firebase 和 Stripe。非常乐意深入聊聊校验库、校准框架或成本模型——一局完整玩下来我的推理成本大约只有 13 美分,这也是免费套餐能够永久免费的唯一原因。

我最希望今天能得到的反馈:告诉我哪一关是不公平的。我是拿自己写的提示词进行校准的,这正是这套方法唯一的盲区。

创始团队

Abdalla Emad
Abdalla EmadSenior Software engineer