- ✓
暂未采集到具体套餐,价格以官网为准
Octen Extract
一个用于告知页面内容的 fetch API。
Octen Extract 是什么?
Octen Extract 是一款专为 AI Agent 设计的网页抓取 API,一次调用即可将最多 20 个 URL 转换为干净、可直接喂给模型的 Markdown 内容,并自动识别页面结构(文章、登录墙、错误页等)与 160+ 主题分类,帮助 Agent 避免在空页面上浪费 token。支持传入查询关键词,返回相关性排序的要点摘要,将 5 万 token 的长页压缩至约 300 token,原生支持 PDF,每 1000 次成功抓取仅需 1 美元,失败请求不收费。
产品详细介绍
一个用于告知页面内容的 fetch API。
Octen Extract 是一款专为 AI Agent 设计的网页抓取 API,一次调用即可将最多 20 个 URL 转换为干净、可直接喂给模型的 Markdown 内容,并自动识别页面结构(文章、登录墙、错误页等)与 160+ 主题分类,帮助 Agent 避免在空页面上浪费 token。支持传入查询关键词,返回相关性排序的要点摘要,将 5 万 token 的长页压缩至约 300 token,原生支持 PDF,每 1000 次成功抓取仅需 1 美元,失败请求不收费。
定价方案
需要付费创始人评论
{"translation":"嗨 Product Hunt!我是 Aaron,Octen 的数据负责人。👋
如果你在构建 AI Agent,你一定遇到过这个问题:fetch 请求返回 HTTP 200,但\"内容\"却是登录墙、Cookie 横幅或软 404 页面。你的 Agent 要等到把页面读进上下文、烧掉一堆 Token 之后才能发现。
Octen Extract 是一个 fetch API,在模型看到任何内容之前先做一次判断。每个 URL 都会返回干净的 Markdown,以及页面的本质信息:结构类型(文章、索引页、登录墙、错误页)和来自 160+ 分类的主题标签——这正是 Octen Search 索引背后的同一套理解引擎。传入一个查询,你会得到按相关性排序的精选摘要,而不是整页内容(我们见过 5 万 Token 的页面被压缩到约 300 Token)。原生支持 PDF。
一次 API 调用最多可处理 20 个 URL,成功抓取每 1,000 页统一收费 \$1,失败的抓取免费。
你的 Agent 最多在\"实际上什么都没有\"的页面上浪费过多少 Token?很期待听听你在构建什么。
"}