Après LM Studio, un autre outil revient souvent quand on parle d’IA locale : Ollama. Là où LM Studio mise sur une interface graphique accessible, Ollama s’adresse à ceux qui veulent une solution simple, rapide et légère pour lancer des modèles depuis le terminal. Ce guide se concentre sur l’installation sur Windows — pour une vue d’ensemble tous systèmes, voyez notre guide complet Ollama.
Sommaire
- Configuration recommandée
- Étape 1 — Installer Ollama
- Étape 2 — Vérifier l’installation
- Étape 3 — Lancer un premier modèle
- Étapes 4-5 — Lister et supprimer des modèles
- Où Ollama stocke les modèles
- Étape 6 — L’API locale
- Ollama et le GPU
- Que faire si Ollama est lent ?
- FAQ
Configuration recommandée
Ollama fonctionne sur Windows 10 ou plus récent. Pour une bonne expérience, TechPi recommande :
| Composant | Recommandation |
|---|---|
| Système | Windows 10 ou Windows 11 |
| CPU | Intel Core ou AMD Ryzen récent |
| RAM | 16 Go minimum, 32 Go conseillé |
| GPU | Optionnel, mais recommandé |
| VRAM | 8 Go conseillé pour plus de confort |
| Stockage | SSD avec 50 Go libres ou plus |
| Connexion | Nécessaire pour télécharger les modèles |
L’installation de base demande au moins 4 Go d’espace, mais les modèles téléchargés peuvent occuper des dizaines, voire des centaines de Go. Pour bien dimensionner votre machine, voyez notre comparatif 16, 32 ou 64 Go de RAM pour l’IA.
Étape 1 — Installer Ollama sur Windows
La méthode la plus simple : télécharger Ollama depuis le site officiel. La page Windows propose un installateur, mais aussi une commande PowerShell :
irm https://ollama.com/install.ps1 | iex
Pour un débutant, le plus simple reste de cliquer sur Download for Windows, puis de lancer l’installateur. Une fois installé, Ollama peut être utilisé depuis PowerShell, Windows Terminal ou l’invite de commandes.
Étape 2 — Vérifier que Ollama fonctionne
Ouvrez PowerShell ou Windows Terminal, puis tapez :
ollama --version
Si Ollama est bien installé, Windows affiche une version ou répond sans erreur.
Étape 3 — Télécharger et lancer un premier modèle
La commande run télécharge un modèle s’il n’est pas présent, puis le lance :
ollama run gemma3
Au premier lancement, Ollama télécharge le modèle (cela peut prendre du temps). Ensuite, écrivez directement vos questions dans le terminal, par exemple :
Explique ce qu'est une IA locale en 5 lignes, avec des mots simples.
Quel modèle choisir pour commencer ?
Pour débuter, évitez les très gros modèles. Préférez un modèle compact, plus rapide à télécharger :
| Profil | Modèle à tester |
|---|---|
| Découverte | TinyLlama, Phi, Gemma compact |
| Usage général | Gemma, Qwen, Llama selon disponibilité |
| Code | Qwen Coder, CodeLlama |
| Vision / image | LLaVA ou modèle vision compatible |
| PC modeste | Modèle 1B à 4B |
| PC confortable | Modèle 7B à 14B |
Étapes 4 et 5 — Lister et supprimer des modèles
Pour voir les modèles présents sur votre PC :
ollama list
Pour supprimer un modèle devenu inutile (les fichiers peuvent être volumineux) :
ollama rm gemma3
Où Ollama stocke-t-il les modèles ?
Par défaut, dans le dossier utilisateur : %HOMEPATH%\.ollama. Si votre disque principal est presque plein, vous pouvez changer l’emplacement via la variable d’environnement OLLAMA_MODELS (à créer dans les variables d’environnement de l’utilisateur, puis relancer l’application). Les modèles IA peuvent vite remplir le disque C:.
Étape 6 — Utiliser Ollama via une API locale
Ollama expose aussi une API locale, disponible par défaut sur :
http://localhost:11434/api
Cela permet de connecter Ollama à des scripts, applications ou interfaces web. Exemple de requête PowerShell :
Invoke-WebRequest -method POST `
-Body '{"model":"gemma3", "prompt":"Explique les PC IA simplement.", "stream": false}' `
-uri http://localhost:11434/api/generate
Ollama peut-il utiliser le GPU ?
Oui, selon le matériel et les pilotes. Ollama documente le support NVIDIA, AMD Radeon et Apple Metal, et permet de contrôler l’usage de plusieurs GPU NVIDIA avec CUDA_VISIBLE_DEVICES. Sur Windows, les GPU NVIDIA restent souvent le choix le plus simple ; les GPU AMD peuvent fonctionner, mais la compatibilité dépend davantage des pilotes.
Que faire si Ollama est lent ?
Si les réponses sont lentes, le modèle est peut-être trop gros pour votre PC. Essayez de : choisir un modèle plus petit, fermer les applications inutiles, vérifier l’espace disque, utiliser un SSD, vérifier que le GPU est bien sollicité, brancher le PC portable au secteur, ou passer à 32 Go de RAM. La règle : plus le modèle est gros, plus il demande de mémoire et de VRAM.
À retenir
Ollama est l’un des meilleurs outils pour lancer une IA locale sur Windows : léger, rapide, et très pratique dès qu’on veut dépasser le simple test. Un peu moins « grand public » que LM Studio car il repose sur le terminal, mais c’est aussi sa force. Pour une expérience visuelle proche de ChatGPT, associez-le ensuite à une interface comme Open WebUI. Et pour la vue d’ensemble tous systèmes, retrouvez notre guide complet Ollama.
FAQ
Oui. La page officielle indique que la version Windows nécessite Windows 10 ou plus récent.
Non, mais il faut accepter d’utiliser quelques commandes dans PowerShell ou Windows Terminal.
Oui, pour les modèles déjà installés localement. Le téléchargement initial des modèles nécessite toutefois une connexion Internet.
Oui. L’API locale d’Ollama est servie par défaut sur http://localhost:11434/api.








