AI工具导航

Rondine

为您的硬件运行合适的本地 LLM

Rondine 是什么?

Rondine 是一款开源的本地大语言模型控制平面,能自动检测设备的内存和显存,推荐合适的模型并应用硬件优化的配置,一键下载权重并启动兼容 OpenAI 接口的本地服务。它支持 Apple Silicon、NVIDIA GPU 以及 DGX Spark,底层整合了 llama.cpp、MLX-LM 和 vLLM 等成熟推理引擎,并在每次启动前向用户清晰展示完整的执行计划,让本地部署大模型变得简单透明。

产品详细介绍

为您的硬件运行合适的本地 LLM

Rondine 是一款开源的本地大语言模型控制平面,能自动检测设备的内存和显存,推荐合适的模型并应用硬件优化的配置,一键下载权重并启动兼容 OpenAI 接口的本地服务。它支持 Apple Silicon、NVIDIA GPU 以及 DGX Spark,底层整合了 llama.cpp、MLX-LM 和 vLLM 等成熟推理引擎,并在每次启动前向用户清晰展示完整的执行计划,让本地部署大模型变得简单透明。

定价方案

需要付费
官网查看
定制方案
  • 暂未采集到具体套餐,价格以官网为准

查看官网价格

创始人评论

Antonello Fratepietro
Antonello Fratepietro创始人

{"translation":"嗨,Product Hunt!之所以打造 Rondine,是因为我反复花在配置本地推理上的时间,比真正使用它的时间还多。\n\n运行本地大语言模型涉及许多相互关联的选择:模型、量化、上下文大小、推理引擎、GPU 卸载、KV 缓存以及内存限制。在 Apple Silicon Mac 上效果良好的配置,到了 NVIDIA 工作站或 DGX Spark 上可能完全不合适。\n\nRondine 将这些决策转化为一个硬件感知的工作流。它会检测机器配置,推荐合适的模型,生成可审查的配置,下载权重,并使用 llama.cpp、MLX-LM 或 vLLM 启动一个兼容 OpenAI 的端点。\n\nRondine 在意大利语中意为"燕子"——一种帮助那些大得离谱的模型展翅起飞的小鸟。\n\n很想听听你们在使用哪些硬件和本地模型,以及在哪些环节设置仍然最为棘手。"}

创始团队

Antonello Fratepietro
Antonello Fratepietro创始团队

官网信息

官网https://github.com/antonellof/rondine
公司使命

面向 Apple Silicon、NVIDIA GPU 和 DGX Spark 的硬件感知本地大语言模型启动器