- ✓
暂未采集到具体套餐,价格以官网为准
Lyrenth
AI 可读的网络索引:呈现干净页面,而非原始 HTML
Lyrenth 是什么?
Lyrenth 是一个为 AI 优化的网页索引服务:每条 URL 只抓取一次,把原始 HTML 清洗成统一的 AIDocument 格式,再分发给所有调用者,让重复读取从秒级降到毫秒级。平台已收录超过 37 亿页面、日增 5000 万,实测中 Stripe API 文档从近 31 万原始 token 压缩到 2000,削减 99.4%。AIDocument 是开放标准,一行命令即可作为 MCP server 接入,还提供免绑卡的免费额度。
产品详细介绍
AI 可读的网络索引:呈现干净页面,而非原始 HTML
Lyrenth 是一个为 AI 优化的网页索引服务:每条 URL 只抓取一次,把原始 HTML 清洗成统一的 AIDocument 格式,再分发给所有调用者,让重复读取从秒级降到毫秒级。平台已收录超过 37 亿页面、日增 5000 万,实测中 Stripe API 文档从近 31 万原始 token 压缩到 2000,削减 99.4%。AIDocument 是开放标准,一行命令即可作为 MCP server 接入,还提供免绑卡的免费额度。
定价方案
需要付费创始人评论
{"translation":"你好,Product Hunt,
我是 Aleksandar,创始人。Lyrenth 是一个自筹资金的项目,我从 2025 年底开始一直在打造它。
事情起源于我在刷社交媒体时看到的一条短帖。有人写道,下一件大事不仅仅是让 AI 更聪明,而是赋予 AI 像人类一样看待网络的能力。在那之后,我就再也无法忽视这个问题了。
每一家 AI 公司、每一个 agent、每一条 RAG 流水线,都在私下解决同一个任务:抓取页面、剥离导航、移除 cookie 横幅、解析破损的 HTML,并一次又一次地为这项工作付出代价。信息早已存在于网络上,缺失的是一个机器可以读取的层。
在构建过程中最大的转变是:我一开始以为价值在于清洗页面。事实并非如此。清洗一个页面很容易。真正的价值在于没人需要重复做这件事。一旦我从"清洗工具"转变为"索引",其余的就顺理成章了。一个 URL 对应一个文档。第一个调用者承担抓取成本,之后的所有请求都从索引中以毫秒级返回,同时兼顾新鲜度,并支持重新索引。而慢的那部分——在那些只输出空壳的页面上运行 JavaScript——只在我们这边发生一次,而不是在每个调用方的机器上重复进行。
第二个转变与爬虫有关。如果你要读取整个公共网络,你就必须成为网站所有者能够识别、验证并随时关停的对象。因此它公开自己的地址、遵守 robots.txt、对请求进行签名,并且不会用其抓取的内容训练基础模型。文档格式本身是一个开放标准,与公司保持独立,因此不依赖于我们是否还存在。
目前的规模:覆盖 1.66 亿个域名上的近 37 亿个页面,每天增长超过 5000 万。Stripe API 参考文档从原始 HTML 的 307,902 个 token 压缩为我们格式下的 2,000 个,重复读取可在毫秒内返回。免费层为每月 2,000 个页面,无需绑定信用卡。
我会尽量阅读这里的每一条评论。如果你觉得有什么需要改进的地方,请告诉我。
Aleksandar
"}