AI工具导航

Mobile LLM Server

在 Android 上运行本地大语言模型。llama.cpp & LiteRT-LM

Mobile LLM Server 是什么?

Mobile LLM Server 让你在 Android 设备上本地运行大语言模型,基于 llama.cpp 与 LiteRT-LM,支持 GGUF 模型格式,把手机变成一台隐私优先的私有 AI 服务器,对外提供与 OpenAI 兼容的 API 接口。所有推理完全在端侧完成,无需联网,兼顾低延迟与数据安全。

产品详细介绍

在 Android 上运行本地大语言模型。llama.cpp & LiteRT-LM

Mobile LLM Server 让你在 Android 设备上本地运行大语言模型,基于 llama.cpp 与 LiteRT-LM,支持 GGUF 模型格式,把手机变成一台隐私优先的私有 AI 服务器,对外提供与 OpenAI 兼容的 API 接口。所有推理完全在端侧完成,无需联网,兼顾低延迟与数据安全。

定价方案

有免费方案
$0/免费
免费
  • 在 Android 上运行本地大语言模型推理

  • 兼容 OpenAI 的 API 服务器

  • Ollama 兼容 API 支持

查看官网价格

创始人评论

李争
李争创始人

在中端手机上,它处理较长上下文的效果如何?在长时间的推理过程中,是否会出现明显的电池消耗?

创始团队

李争
李争Mobile AI runtime for local LLMs

官网信息

官网https://play.google.com/store/apps/details?id=com.chaterminal.mobilellm
公司使命

完全离线运行高级大语言模型,无需依赖云端、无需登录、也无需数据共享。直接在您的手机上体验私密、快速且安全的人工智能。

所在地

Wuchang District, Wuhan City, Hubei Province, China