LLM Server — On-Device AI API

Calificación del contenido
Apto para todo público
1+
Descargas
Calificación del contenido
Apto para todo público
Más información
Imagen de la captura de pantalla
Imagen de la captura de pantalla
Imagen de la captura de pantalla
Imagen de la captura de pantalla
Imagen de la captura de pantalla
Imagen de la captura de pantalla
Imagen de la captura de pantalla
Imagen de la captura de pantalla

Acerca de esta app

★ Convierte tu teléfono en un servidor de IA ★

LLM Server te permite ejecutar modelos de lenguaje complejos directamente en tu dispositivo Android y exponerlos como un punto final de API local al que cualquier aplicación, script o agente de IA puede conectarse.

Sin nube. Sin suscripciones. Tu teléfono se convierte en el backend de IA.

━━━━━━━━━━━━━━━━━━━━━━━━━━━━

🧠 INFERENCIA EN EL DISPOSITIVO
• Ejecuta modelos LLM de peso abierto (Llama, Gemma, Phi, Qwen, Mistral y más)
• Optimizado para hardware móvil con cuantización GGUF
• Privacidad total: tus datos nunca salen de tu dispositivo
• Funciona completamente sin conexión una vez descargados los modelos

🔌 SERVIDOR API INTEGRADO
• API REST compatible con OpenAI disponible desde tu teléfono
• Conecta cualquier herramienta que utilice el formato de API de OpenAI
• Transmite respuestas en tiempo real mediante eventos enviados por el servidor
• Atiende a múltiples clientes en tu red local

🤖 IDEAL PARA AGENTES DE IA
• Deja que tu IA explore Los asistentes utilizan tu teléfono como backend de LLM.
• Agente Hermes, LangChain, AutoGPT: cualquier sistema con HTTP.
• Compatibilidad con Tailscale/ZeroTier para acceso remoto seguro.
• No se necesitan claves API: el modelo es tuyo.

📱 CÓMO FUNCIONA
1. Descarga un modelo desde el navegador de modelos integrado.
2. Pulsa "Iniciar servidor" para abrir el endpoint de la API.
3. Dirige cualquier cliente a http://tu-ip-del-teléfono:8080/v1/chat/completions.
4. ¡Listo! Tu teléfono ahora es un servidor de IA.

🔧 DETALLES TÉCNICOS
• Backend llama.cpp para inferencia rápida con CPU/GPU.
• ​​Compatible con modelos GGUF (Q4_K_M, Q5_K_M, Q8_0 y más).
• Endpoint /v1/chat/completions compatible con OpenAI.
• Longitud de contexto, temperatura y muestreo configurables.
• El servicio en segundo plano sigue funcionando incluso cuando la aplicación está minimizada.
• Inferencia optimizada para ahorrar batería. Programación

━━━━━━━━━━━━━━━━━━━━━━━━━━━━

💡 CASOS DE USO
• Asistente personal de IA que funciona al 100% en tu dispositivo
• Desarrollo y pruebas: prototipos de funciones de IA sin costes de la nube
• Backend para agentes de IA: permite que los agentes autónomos utilicen tu teléfono como su cerebro
• IA que prioriza la privacidad: los datos confidenciales nunca se almacenan en la nube
• IA sin conexión: funciona en aviones, túneles, en cualquier lugar

🔒 PRIVACIDAD Y SEGURIDAD
• Toda la inferencia se realiza en el dispositivo
• Sin recopilación de datos, sin telemetría, sin dependencia de la nube
• El servidor API solo es accesible en tu red local por defecto
• Ecosistema de modelos de código abierto: sin proveedores Bloqueo

━━━━━━━━━━━━━━━━━━━━━━━━━━━━

LLM Server conecta los potentes modelos de IA de código abierto con los dispositivos que usas a diario. Deja de pagar por las llamadas a la API en la nube: ejecuta tu propia IA, a tu manera.

Descárgala ahora y convierte tu teléfono en una potente herramienta de IA.
Ejecuta modelos de IA en tu teléfono y ofrécelos como un punto final de API para cualquier aplicación.
Actualización
31 ago 2026

Seguridad de los datos

El primer paso de la seguridad es comprender cómo los desarrolladores recopilan y comparten tus datos. Las prácticas de privacidad y seguridad de datos pueden variar en función del uso de la app, la región y la edad. El desarrollador proporcionó esta información y podría actualizarla con el tiempo.
  • No se comparten datos con terceros
    Más información sobre cómo los desarrolladores declaran el uso compartido
  • No se recopilan datos
    Más información sobre cómo los desarrolladores declaran la recopilación

Novedades

v1.7.0 — Improved first-launch experience with automatic starter model setup. New users get a working AI model within a minute of opening the app.
Calificación del contenido
Apto para todo público
Más información

Asistencia de la app

Número de teléfono
+12135339019
Acerca del desarrollador
chan hing tat
c_matrix50@hotmail.com
38 Russell St 銅鑼灣 香港島 Hong Kong

Más de magnus2026