- ✓
暂未采集到具体套餐,价格以官网为准
Rondine
为您的硬件运行合适的本地 LLM
Rondine 是什么?
Rondine 是一款开源的本地大语言模型控制平面,能自动检测设备的内存和显存,推荐合适的模型并应用硬件优化的配置,一键下载权重并启动兼容 OpenAI 接口的本地服务。它支持 Apple Silicon、NVIDIA GPU 以及 DGX Spark,底层整合了 llama.cpp、MLX-LM 和 vLLM 等成熟推理引擎,并在每次启动前向用户清晰展示完整的执行计划,让本地部署大模型变得简单透明。
产品详细介绍
为您的硬件运行合适的本地 LLM
Rondine 是一款开源的本地大语言模型控制平面,能自动检测设备的内存和显存,推荐合适的模型并应用硬件优化的配置,一键下载权重并启动兼容 OpenAI 接口的本地服务。它支持 Apple Silicon、NVIDIA GPU 以及 DGX Spark,底层整合了 llama.cpp、MLX-LM 和 vLLM 等成熟推理引擎,并在每次启动前向用户清晰展示完整的执行计划,让本地部署大模型变得简单透明。
定价方案
需要付费创始人评论
{"translation":"嗨,Product Hunt!之所以打造 Rondine,是因为我反复花在配置本地推理上的时间,比真正使用它的时间还多。\n\n运行本地大语言模型涉及许多相互关联的选择:模型、量化、上下文大小、推理引擎、GPU 卸载、KV 缓存以及内存限制。在 Apple Silicon Mac 上效果良好的配置,到了 NVIDIA 工作站或 DGX Spark 上可能完全不合适。\n\nRondine 将这些决策转化为一个硬件感知的工作流。它会检测机器配置,推荐合适的模型,生成可审查的配置,下载权重,并使用 llama.cpp、MLX-LM 或 vLLM 启动一个兼容 OpenAI 的端点。\n\nRondine 在意大利语中意为"燕子"——一种帮助那些大得离谱的模型展翅起飞的小鸟。\n\n很想听听你们在使用哪些硬件和本地模型,以及在哪些环节设置仍然最为棘手。"}
创始团队
官网信息
面向 Apple Silicon、NVIDIA GPU 和 DGX Spark 的硬件感知本地大语言模型启动器