Über Local LLM
Auf dem Gerät LLM.
Local LLM führt offene KI-Modelle direkt auf Ihrem Smartphone aus. Es ist kein Server, kein Konto und keine Internetverbindung erforderlich, sobald ein Modell heruntergeladen ist. Ihre Unterhaltungen verlassen Ihr Gerät nicht.
WARUM AUF DEM GERÄT?
Jede Ihrer Eingaben wird von einem Modell beantwortet, das auf Ihrer eigenen Hardware läuft. Es werden keine Daten hochgeladen, nichts auf einem Server protokolliert und nichts wird zum Trainieren anderer Modelle verwendet. Selbst im Flugmodus funktioniert es.
WÄHLE DEIN MODELL
Sieben Modelle stehen in der App zur Verfügung, vom 369 MB großen SmolLM2, das auch auf schwächerer Hardware flüssig läuft, bis hin zum Llama 3.2 mit 3 MB für präzisere Antworten:
• SmolLM2 360M – schnellstes Modell, geringster RAM-Verbrauch
• Qwen2.5 0,5B – sehr schnell, solide Qualität
• TinyLlama 1,1B – schlankes, klassisches Modell
• Llama 3.2 1B – ausgewogenes Standardmodell
• Qwen2.5 1,5B – präzisere Argumentation
• Gemma 2 2B – hohe Qualität, etwas langsamer
• Llama 3.2 3B – beste Qualität, benötigt etwas mehr Speicherplatz
Die genaue Downloadgröße jedes Modells wird vor dem Download angezeigt. Du kannst auch einen direkten Link zu einem beliebigen GGUF-Modell einfügen und jederzeit das Modell wechseln, ohne den Chat zu verlassen.
CHAT, DER SICH ERINNERT
Unterhaltungen werden in einer privaten Datenbank auf deinem Gerät gespeichert. Die Titel werden vom Modell automatisch generiert, sodass Ihr Chatverlauf leicht zu überblicken ist. Öffnen Sie vergangene Chats erneut oder löschen Sie alle mit einem Fingertipp. Markdown wird korrekt dargestellt, inklusive Syntaxhervorhebung in Codeblöcken und Ein-Finger-Kopieren.
LOKALE API FÜR IHRE ANDEREN GERÄTE
Aktivieren Sie den optionalen API-Dienst. Ihr Smartphone stellt das Modell dann über einen OpenAI-kompatiblen HTTP-Endpunkt in Ihrem lokalen Netzwerk bereit. Verwenden Sie einen beliebigen OpenAI-Client – z. B. curl, das Python SDK oder Ihre eigenen Skripte – und erhalten Sie Vervollständigungen vom Modell direkt in Ihrer Hosentasche, per USB oder WLAN. Streaming wird unterstützt. Die Funktion ist standardmäßig deaktiviert und wird während der Aktivierung durch eine Benachrichtigung angezeigt.
AUSGEWÄHLTER DATENSCHUTZ
• Kein Konto, keine Anmeldung, keine Werbung
• Chats werden nur auf Ihrem Gerät gespeichert
• Nachrichtentexte werden niemals übertragen
• Nur anonyme Nutzungsanalysen, niemals Nachrichteninhalte
HINWEIS ZU DEN KI-AUSGABEN
Die Antworten stammen von lokal ausgeführten Open-Weight-Modellen. Diese Informationen können fehlerhaft, veraltet oder ungeeignet sein und werden von niemandem überprüft. Bitte verlassen Sie sich bei medizinischen, rechtlichen oder finanziellen Entscheidungen nicht darauf.
VORAUSSETZUNGEN
Android 7.0 oder höher, 64-Bit-Gerät. Einmaliger Modell-Download von mindestens 369 MB und ca. 1–3 GB freier Arbeitsspeicher (RAM), abhängig vom gewählten Modell. Größere Modelle laufen auf älteren Smartphones spürbar langsamer.
What's new in the latest 1.0
• Chat with AI models that run entirely on your phone. No cloud, no account, and nothing you type ever leaves the device.
• Choose from seven models, from a 369 MB SmolLM2 up to Llama 3.2 3B, or paste a link to your own GGUF file.
• Conversations are saved on-device, with titles written by the model itself.
• Optional local API, OpenAI-compatible, so your laptop can use the model over USB or Wi-Fi.
Local LLM APK -Informationen
Alte Versionen von Local LLM
Superschnelles und sicheres Herunterladen über die APKPure-App
Ein Klick zur Installation von XAPK/APK-Dateien auf Android!





