À propos de Local LLM
Sur l'appareil LLM.
Local LLM exécute des modèles d'IA open-weight directement sur votre téléphone. Une fois le modèle téléchargé, aucun serveur, aucun compte ni connexion Internet ne sont nécessaires. Vos conversations restent sur votre appareil.
POURQUOI UNE UTILISATION SUR L'APPAREIL ?
Chaque commande que vous saisissez est traitée par un modèle exécuté sur votre propre matériel. Aucune donnée n'est téléchargée, aucune donnée n'est enregistrée sur un serveur et aucune information n'est utilisée pour entraîner un modèle tiers. Même en mode avion, l'application fonctionne.
CHOISISSEZ VOTRE MODÈLE
Sept modèles sont disponibles dans l'application, du SmolLM2 (369 Mo), idéal pour les configurations modestes, au Llama 3.2 (3 octets) pour des réponses plus performantes :
• SmolLM2 (360 Mo) : le plus rapide, faible consommation de RAM
• Qwen2.5 (0,5 octet) : très rapide, excellente qualité
• TinyLlama (1,1 octet) : modèle classique et léger
• Llama 3.2 (1 octet) : modèle par défaut équilibré
• Qwen2.5 (1,5 octet) : raisonnement plus poussé
• Gemma 2 (2 octets) : haute qualité, un peu plus lent
• Llama 3.2 (3 octets) : qualité optimale, nécessite une mémoire vive plus importante
La taille exacte du téléchargement est affichée pour chaque modèle avant validation. Vous pouvez également coller un lien direct vers le modèle GGUF de votre choix et changer de modèle à tout moment sans quitter votre conversation.
DES CONVERSATIONS QUI SONT SOUVENUES
Vos conversations sont enregistrées dans une base de données privée sur votre appareil. Les titres sont générés automatiquement par le modèle, ce qui facilite la consultation de votre historique. Rouvrez une conversation passée ou effacez-les toutes d'un simple clic. Le Markdown s'affiche correctement, avec la coloration syntaxique des blocs de code et la copie en un clic.
UNE API LOCALE POUR VOS AUTRES APPAREILS
Activez le service API optionnel : votre téléphone diffusera le modèle via un point de terminaison HTTP compatible OpenAI sur votre réseau local. Connectez n'importe quel client OpenAI à ce point de terminaison (curl, le SDK Python, vos propres scripts) et obtenez des suggestions du modèle directement sur votre téléphone, via USB ou Wi-Fi. Le streaming est pris en charge. Il reste désactivé par défaut et une notification s'affiche lorsqu'il est actif.
CONÇU POUR RESPECTER VOTRE VIE PRIVÉE
• Aucun compte, aucune connexion, aucune publicité
• Conversations stockées uniquement sur votre appareil
• Le texte des messages n'est jamais transmis
• Analyses d'utilisation anonymes uniquement, jamais le contenu des messages
REMARQUE SUR LES RÉSULTATS DE L'IA
Les réponses proviennent de modèles à poids ouvert exécutés localement. Ces informations peuvent être erronées, obsolètes ou inadaptées, et ne sont vérifiées par personne. Veuillez ne pas vous y fier pour prendre des décisions médicales, juridiques ou financières.
CONFIGURATION REQUISE
Android 7.0 ou version ultérieure, appareil 64 bits. Téléchargement unique du modèle (369 Mo minimum) et environ 1 à 3 Go de RAM disponible selon le modèle choisi. Les modèles plus volumineux sont sensiblement plus lents sur les téléphones plus anciens.
What's new in the latest 1.0
• Chat with AI models that run entirely on your phone. No cloud, no account, and nothing you type ever leaves the device.
• Choose from seven models, from a 369 MB SmolLM2 up to Llama 3.2 3B, or paste a link to your own GGUF file.
• Conversations are saved on-device, with titles written by the model itself.
• Optional local API, OpenAI-compatible, so your laptop can use the model over USB or Wi-Fi.
Informations Local LLM APK
Vieilles versions de Local LLM
Téléchargement super rapide et sûr via l'application APKPure
Un clic pour installer les fichiers XAPK/APK sur Android!





