LLM Server — On-Device AI API

Classification du contenu
Tout public
1+
Téléchargements
Classification du contenu
Tout public
En savoir plus
Capture d'écran
Capture d'écran
Capture d'écran
Capture d'écran
Capture d'écran
Capture d'écran
Capture d'écran
Capture d'écran

À propos de l'application

★ Transformez votre téléphone en serveur d'IA ★

LLM Server vous permet d'exécuter des modèles de langage complexes directement sur votre appareil Android et de les exposer via une API locale à laquelle toute application, script ou agent d'IA peut se connecter.

Sans cloud. Sans abonnement. Votre téléphone devient le serveur d'IA.

━━━━━━━━━━━━━━━━━━━━━━━━━━━━

🧠 INFÉRENCE SUR APPAREIL

• Exécution de modèles linéaires à poids ouverts (Llama, Gemma, Phi, Qwen, Mistral et plus)

• Optimisé pour le matériel mobile avec la quantification GGUF

• Confidentialité totale : vos données ne quittent jamais votre appareil

• Fonctionnement entièrement hors ligne une fois les modèles téléchargés

🔌 SERVEUR API INTÉGRÉ

• API REST compatible OpenAI accessible depuis votre téléphone

• Connexion à tout outil compatible avec le format d’API OpenAI

• Diffusion des réponses en temps réel via les événements envoyés par le serveur (SSE)

• Gestion de plusieurs clients sur votre réseau local

🤖 IDÉAL POUR LES AGENTS IA

• Permettez à vos assistants IA de… Utilisez votre téléphone comme serveur LLM

• Compatible avec Hermes Agent, LangChain, AutoGPT et tout protocole HTTP

• Prise en charge de Tailscale/ZeroTier pour un accès distant sécurisé

• Aucune clé API requise : le modèle vous appartient

📱 FONCTIONNEMENT

1. Téléchargez un modèle depuis le navigateur de modèles intégré
2. Appuyez sur « Démarrer le serveur » pour lancer le point de terminaison API
3. Accédez à http://votre-ip-de-téléphone:8080/v1/chat/completions depuis n’importe quel client
4. Et voilà ! Votre téléphone est désormais un serveur d’IA

🔧 DÉTAILS TECHNIQUES

• Serveur llama.cpp pour une inférence CPU/GPU rapide

• Compatible avec les modèles GGUF (Q4_K_M, Q5_K_M, Q8_0 et plus)

• Point de terminaison /v1/chat/completions compatible OpenAI

• Longueur du contexte, température et échantillonnage configurables

• Service en arrière-plan fonctionnant même lorsque l’application est réduite

• Inférence optimisée pour la batterie Planification

━━━━━━━━━━━━━━━━━━━━━━━━━━━

💡 CAS D'UTILISATION

• Assistant IA personnel fonctionnant intégralement sur votre appareil

• Développement et tests : prototypez des fonctionnalités d'IA sans frais de cloud

• Serveur d'agent IA : permettez à des agents autonomes d'utiliser votre téléphone comme cerveau

• IA respectueuse de la vie privée : les données sensibles ne transitent jamais par le cloud

• IA hors ligne : fonctionne dans les avions, les tunnels, partout

🔒 CONFIDENTIALITÉ ET SÉCURITÉ

• Toutes les inférences sont effectuées sur l'appareil

• Aucune collecte de données, aucune télémétrie, aucune dépendance au cloud

• Serveur API accessible uniquement sur votre réseau local par défaut

• Écosystème open source : aucun fournisseur Verrouillage

━━━━━━━━━━━━━━━━━━━━━━━━━━━━

LLM Server fait le lien entre les puissants modèles d'IA open source et les appareils que vous utilisez au quotidien. Arrêtez de payer pour les appels d'API cloud : exécutez votre propre IA, selon vos propres conditions.

Téléchargez maintenant et transformez votre téléphone en un véritable centre de contrôle de l'IA.
Exécutez des modèles d'IA sur votre téléphone et mettez-les à disposition sous forme de point de terminaison API pour n'importe quelle application.
Date de mise à jour
31 août 2026

Sécurité des données

La sécurité, c'est d'abord comprendre comment les développeurs collectent et partagent vos données. Les pratiques concernant leur confidentialité et leur protection peuvent varier selon votre utilisation, votre région et votre âge. Le développeur a fourni ces informations et peut les modifier ultérieurement.
  • Aucune donnée partagée avec des tiers
    En savoir plus sur la manière dont les développeurs déclarent le partage
  • Aucune donnée collectée
    En savoir plus sur la manière dont les développeurs déclarent la collecte

Nouveautés

v1.7.0 — Improved first-launch experience with automatic starter model setup. New users get a working AI model within a minute of opening the app.
Classification du contenu
Tout public
En savoir plus

Assistance de l'appli

Numéro de téléphone
+12135339019
À propos du développeur
chan hing tat
c_matrix50@hotmail.com
38 Russell St 銅鑼灣 香港島 Hong Kong

Autres applications de "magnus2026"