- ✓
Notion AI 试用
- ✓
基础表单
- ✓
基础网站
Kineforge AI/ML model for robotics
无需演示,单GPU即可训练机器人模型
Kineforge AI/ML model for robotics 是什么?
Kineforge AI/ML model for robotics 是一款专为机器人设计的 AI 训练模型,它无需人工遥操作演示,仅靠单张 GPU 就能在数小时内完成机器人控制策略训练。结合冻结语义先验、可微分物理(MuJoCo MJX)与仅15.7万参数的轻量化策略设计,它能实现低于10毫秒的CPU推理,遵循以结构取胜而非盲目扩张规模的设计理念。
产品详细介绍
无需演示,单GPU即可训练机器人模型
Kineforge AI/ML model for robotics 是一款专为机器人设计的 AI 训练模型,它无需人工遥操作演示,仅靠单张 GPU 就能在数小时内完成机器人控制策略训练。结合冻结语义先验、可微分物理(MuJoCo MJX)与仅15.7万参数的轻量化策略设计,它能实现低于10毫秒的CPU推理,遵循以结构取胜而非盲目扩张规模的设计理念。
定价方案
有免费方案- ✓
免费版中的所有功能
- ✓
Notion AI 试用
- ✓
自定义表单
- ✓
Plus 全部功能
- ✓
Notion 智能代理
- ✓
AI 会议记录
创始人评论
嘿 Product Hunt 👋 我是 Illia,Brightforge 的独立创始人。
在推出我们的 AI 视频工作室 Pixlie 之后,这次带来的是我们的研究项目:Kineforge。
目前的问题是:训练机器人执行任务通常只能选择两种成本高昂的方案——要么记录数千次人类遥操作演示,要么运行仅能部署在云端的数十亿参数“机器人大脑”模型。这两种方式都速度缓慢、成本高昂,并且难以部署在真正需要它们的场景(仓库、实验室、危险场地)。
Kineforge 押注了一个不同的方向:结构优于规模。
• 无需人类演示。我们在仿真环境(MuJoCo MJX)中训练,不依赖遥操作录制数据
• 极小的可训练策略 —— 仅 15.7 万参数(而非数十亿),基于固定的“知识层”构建,从训练第一天起就为智能体提供结构支撑
• 在单块 GPU 上数小时即可完成训练,无需集群训练数周
• 在 CPU 上推理耗时低于 10 毫秒 —— 可边缘部署,无需数据中心
在 NVIDIA H200 上,我们通过开放指标和真实仿真工件记录到稳定任务成功率约为 0.70(超过 34.5 万步日志,在 150 万步运行中零崩溃)。
目前还处于早期阶段,优先做仿真,下一步计划开展真实机器人试点。我非常期待得到机器人学、强化学习和具身 AI 领域从业者的反馈,也希望能认识那些正受数据成本问题困扰的仓库/实验室自动化团队。
想象一下训练机器人完成一项工作。
如今有两种缓慢且昂贵的方式:
1) 让人类花几个月时间数千次“操控”机器人(遥操作)。缓慢。昂贵。枯燥。无法规模化。
2) 租用一个拥有数十亿参数的巨型 AI“大脑”,它只能在大型云端数据中心运行。每次推理都花费不菲。
Kineforge 的做法不同。我们给机器人提供一个小巧智能的“初始大脑”,它已经理解结构 —— 就像上学的孩子已经认识字母,不需要从零开始发明语言。
然后它在类似电子游戏的快速模拟器中练习(没有真实世界风险,不需要人类操控)。它能在单块芯片上几小时内学会任务,不需要在服务器集群上训练数周。
给企业带来的回报:
• 训练数据需求降低 10 到 50 倍
• 开发每项新技能的成本降低 5 到 10 倍
• 最终的“大脑”体积非常小 —— 它可以在机器内部的廉价芯片上瞬间运行,每次动作都不会产生云费用。
想象一下训练机器人完成一项工作。
如今有两种缓慢且昂贵的方式:
1) 让人类花几个月时间数千次“操控”机器人(遥操作)。缓慢。昂贵。枯燥。无法规模化。
2) 租用一个拥有数十亿参数的巨型 AI“大脑”,它只能在大型云端数据中心运行。每次推理都花费不菲。
Kineforge 的做法不同。我们给机器人提供一个小巧智能的“初始大脑”,它已经理解结构 —— 就像上学的孩子已经认识字母,不需要从零开始发明语言。
然后它在类似电子游戏的快速模拟器中练习(没有真实世界风险,不需要人类操控)。它能在单块芯片上几小时内学会任务,不需要在服务器集群上训练数周。
给企业带来的回报:
• 训练数据需求降低 10 到 50 倍
• 开发每项新技能的成本降低 5 到 10 倍
• 最终的“大脑”体积非常小 —— 它可以在机器内部的廉价芯片上瞬间运行,每次动作都不会产生云费用。
因此,相较于“智能但运行成本高到离谱的 AI”,你得到的是“性能足够好,同时价格足够低,完全可以部署到数千台机器上的 AI”。这就是原型Demo和可落地业务之间的区别。
我们已经在仿真中验证了其经济性。下一步是将它部署到真实的仓库机器人中。
技术细节:
• POMDP 控制,动作分解为移动 (16) / 呼吸 (2) / 头部 (2) / 宏动作 (4) = 每步 24 个离散决策
• 多流策略:Fast(反射)、Valence(情感调制增益)、Slow(拓扑路由规划)
• 固定语义先验(约 260 万参数,110 个规范符号,768 维)提供结构化归纳偏置;仅训练约 15.7 万策略参数(REINFORCE/PPO,JEPA 风格 + 结构正则化)
• 后端:MuJoCo MJX 可微分物理,原生 JAX(核心不依赖 PyTorch),Kubernetes 上的 SkyPilot,NVIDIA H200,MLflow 跟踪
• 结果:10 万步时任务奖励约为 0.70;约 159(基线)对比 108(接地感知)环境步数/秒;CPU 推理目标 https://illiaovcharenko1.github....
链接
• PDF (v1.0): 技术报告 PDF
• 落地页: GitHub Pages
• GitHub: kineforge-portfolio
• HuggingFace (HF Space): kineforge-demo
• arXiv: 等待 endorse(cs.RO) → 发布后见 https://arxiv.org/abs/…
• 联系我: illia.ovcharenko@brightforge.ltd · brightforge.ltd
快来试用demo,有任何问题都可以在下方问我 🙏
官网信息
集笔记、文档、项目管理和知识库于一体的一站式工作空间