★ Forvandl din telefon til en AI-server ★
LLM Server giver dig mulighed for at køre store sprogmodeller direkte på din Android-enhed – og eksponere dem som et lokalt API-slutpunkt, som enhver app, script eller AI-agent kan oprette forbindelse til.
Ingen cloud. Ingen abonnementer. Din telefon bliver AI-backend.
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🧠 INFERENCE PÅ ENHEDEN
• Kør open-weight LLM'er (Llama, Gemma, Phi, Qwen, Mistral og mere)
• Optimeret til mobil hardware med GGUF-kvantisering
• Fuld privatliv — dine data forlader aldrig din enhed
• Fungerer fuldstændig offline, når modellerne er downloadet
🔌 INDBYGGET API-SERVER
• OpenAI-kompatibel REST API serveret fra din telefon
• Tilslut ethvert værktøj, der taler OpenAI API-formatet
• Stream svar i realtid via Server-Sent Events
• Betjen flere klienter på dit lokale netværk
🤖 PERFEKT TIL AI-AGENTER
• Lad dine AI-assistenter ringe til dig telefon som en LLM-backend
• Hermes Agent, LangChain, AutoGPT — alt med HTTP
• Tailscale/ZeroTier-understøttelse til sikker fjernadgang
• Ingen API-nøgler nødvendige — du ejer modellen
📱 SÅDAN VIRKER DET
1. Download en model fra den indbyggede modelbrowser
2. Tryk på "Start server" for at starte API-slutpunktet
3. Peg en hvilken som helst klient til http://your-phone-ip:8080/v1/chat/completions
4. Det var det — din telefon er nu en AI-server
🔧 TEKNISKE DETALJER
• llama.cpp-backend til hurtig CPU/GPU-inferens
• Understøtter GGUF-modeller (Q4_K_M, Q5_K_M, Q8_0 og flere)
• OpenAI-kompatibel /v1/chat/completions-slutpunkt
• Konfigurerbar kontekstlængde, temperatur og sampling
• Baggrundstjenesten fortsætter med at fungere, selv når appen er minimeret
• Batterioptimeret inferens planlægning
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
💡 BRUGSEKSPLOSIONER
• Personlig AI-assistent, der kører 100% på din enhed
• Udvikling og test — prototype AI-funktioner uden cloudomkostninger
• AI-agent-backend — lad autonome agenter bruge din telefon som deres hjerne
• Privatlivsorienteret AI — følsomme data rører aldrig skyen
• Offline AI — fungerer på fly, i tunneler, hvor som helst
🔒 PRIVATLIV OG SIKKERHED
• Al inferens sker på enheden
• Ingen dataindsamling, ingen telemetri, ingen cloudafhængighed
• API-server kun tilgængelig på dit lokale netværk som standard
• Open source-modeløkosystem — ingen leverandør lock-in
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
LLM Server bygger bro mellem kraftfulde open source AI-modeller og de enheder, du bærer hver dag. Stop med at betale for cloud API-kald — kør din egen AI, på dine egne betingelser.
Download nu, og forvandl din telefon til et AI-kraftværk.
Kør AI-modeller på din telefon, og server dem som et API-slutpunkt for enhver app