Utiliser une IA locale hors ligne
Cette page = installation (tant qu'il y a internet) + aide-mémoire en cas d'urgence. Logiciel d'exemple : Ollama (gratuit, Windows/macOS/Linux). Alternatives avec interface graphique : LM Studio, GPT4All.
Principe
Les modèles locaux fonctionnent entièrement sans internet — mais seulement si le programme et les fichiers du modèle ont déjà été téléchargés. Installez et testez maintenant, pas pendant le black-out !
Installation d'Ollama (une seule fois, nécessite internet)
- Télécharger le programme d'installation sur ollama.com/download et l'installer. Ollama fonctionne ensuite en arrière-plan (icône dans la zone de notification) et est accessible sur le PC à l'adresse
http://localhost:11434. - Ouvrir l'invite de commandes/PowerShell et télécharger un modèle :
ollama pull <modele>(exemples ci-dessous). - Tester :
ollama run <modele>→ poser une question → quitter avec/bye. - Test hors ligne : couper le Wi-Fi/débrancher le câble réseau et poser une nouvelle question.
- Emplacement des modèles sous Windows :
%USERPROFILE%\.ollama\models. Peu de place surC:? Définir la variable d'environnementOLLAMA_MODELSvers un autre dossier et redémarrer Ollama. Ce dossier peut aussi être copié par clé USB sur un PC sans internet.
Quel modèle ? (valeurs indicatives)
Règle empirique de la documentation d'Ollama : au moins 8 Go de RAM pour les modèles 7B, 16 Go pour 13B, 32 Go pour 33B (« B » = milliards de paramètres). Une carte graphique avec beaucoup de mémoire rend les réponses nettement plus rapides, mais n'est pas indispensable.
| Catégorie | Usage | Exemples (noms Ollama) | Téléchargement env. |
|---|---|---|---|
| Petit (1–4B) | Fonctionnement sur batterie, ordinateurs peu puissants, questions courtes et rapides | llama3.2:3b, gemma3:4b, qwen3:4b |
2–3 Go |
| Moyen (7–14B) | Polyvalent : connaissances, conseils, textes ; bon compromis | qwen3:8b, llama3.1:8b, gemma3:12b, qwen3:14b |
5–9 Go |
| Grand (27B et plus) | Meilleure qualité, uniquement avec beaucoup de RAM/une carte graphique puissante | gemma3:27b, qwen3:32b |
17–20 Go |
- Recommandation : un modèle polyvalent moyen + un petit modèle rapide pour le fonctionnement sur batterie.
- Pour des questions en français, choisir un modèle multilingue et le tester au préalable.
- Les noms et versions des modèles changent en permanence — liste actuelle sur ollama.com/library.
Vérification immédiate (tant qu'internet est encore disponible)
- [ ] Au moins un modèle disponible localement ? (
ollama listou LM Studio → My Models) - [ ] Un modèle polyvalent grand/moyen (connaissances/conseils) + un petit modèle rapide (fonctionnement sur batterie) disponibles ?
- [ ] L'IA démarre-t-elle sans réseau ? Test : Wi-Fi coupé → poser une question
- [ ] Cette base hors ligne est-elle accessible à l'IA ? (dossier
wissen\utilisable comme contexte)
Ollama — commandes rapides
ollama list # afficher les modèles installés
ollama pull <modele> # télécharger un modèle (nécessite internet)
ollama run <modele> # démarrer une conversation
ollama ps # afficher les modèles actuellement chargés
ollama serve # démarrer le serveur manuellement (s'il ne tourne pas en arrière-plan)
/bye # terminer la conversation
Partager l'IA avec tous les appareils du Wi-Fi local
Routeur allumé (courant !) = le réseau local fonctionne sans internet.
- Sur l'ordinateur qui fait tourner l'IA, définir la variable d'environnement
OLLAMA_HOSTsur0.0.0.0(Windows : « Modifier les variables d'environnement pour votre compte »), puis quitter Ollama (icône dans la zone de notification) et le relancer. - Pare-feu Windows : autoriser les connexions entrantes sur le port 11434 — uniquement sur votre propre réseau de confiance !
- Noter l'adresse IP de l'ordinateur :
ipconfig→ adresse IPv4, p. ex. 192.168.x.x → la noter ici : …… - Autres appareils : dans une application de chat ou une interface web, indiquer
http://<IP>:11434comme serveur Ollama. Installer l'interface web (p. ex. Open WebUI) ou l'application au préalable — cela ne fonctionne qu'avec internet.
Usage judicieux en cas d'urgence
Bien adapté : - Expliquer : « Comment poser un pansement compressif ? » (à vérifier avec cette base !) - Traduire, rédiger des textes, calculer, planifier (« Rationne 6 L d'eau pour 2 personnes sur 4 jours ») - Improviser : « Que puis-je construire/cuisiner avec X et Y ? » - Interroger cette base de connaissances : copier le contenu d'un fichier MD dans le prompt + poser la question
Prudence (risque d'hallucination !) :
- Posologies de médicaments, mélanges chimiques, installations électriques → toujours vérifier avec les fichiers du dossier wissen\ ou la notice
- Faits locaux (adresses, fréquences, numéros de téléphone) — le modèle ne les connaît pas de manière fiable → c'est à cela que sert cette base
Modèle de prompt pour les questions d'urgence
Tu es un conseiller d'urgence précis. Réponds brièvement, par étapes,
et indique d'abord les avertissements de sécurité. Si tu n'es pas sûr,
dis-le explicitement. Contexte : coupure de courant, pas d'internet,
foyer en <PAYS>. Question : <QUESTION>
Économiser l'énergie en utilisant l'IA
- Petit modèle (3–8B) plutôt qu'un grand : une fraction de la consommation, suffisant pour les questions courantes
- Regrouper les questions en une seule session, puis mettre l'ordinateur portable en veille
- Ordinateur portable plutôt que de bureau (un PC de bureau consomme 5 à 10 fois plus)
- Règle empirique : session d'IA sur ordinateur portable ~50–100 W → avec une station électrique de 1000 Wh, ~10 à 15 h d'utilisation