Installer Ollama sur Windows : le guide pas à pas (2026)

Après LM Studio, un autre outil revient souvent quand on parle d’IA locale : Ollama. Là où LM Studio mise sur une interface graphique accessible, Ollama s’adresse à ceux qui veulent une solution simple, rapide et légère pour lancer des modèles depuis le terminal. Ce guide se concentre sur l’installation sur Windows — pour une vue d’ensemble tous systèmes, voyez notre guide complet Ollama.

Sommaire

Configuration recommandée

Ollama fonctionne sur Windows 10 ou plus récent. Pour une bonne expérience, TechPi recommande :

Composant Recommandation
Système Windows 10 ou Windows 11
CPU Intel Core ou AMD Ryzen récent
RAM 16 Go minimum, 32 Go conseillé
GPU Optionnel, mais recommandé
VRAM 8 Go conseillé pour plus de confort
Stockage SSD avec 50 Go libres ou plus
Connexion Nécessaire pour télécharger les modèles

L’installation de base demande au moins 4 Go d’espace, mais les modèles téléchargés peuvent occuper des dizaines, voire des centaines de Go. Pour bien dimensionner votre machine, voyez notre comparatif 16, 32 ou 64 Go de RAM pour l’IA.

Étape 1 — Installer Ollama sur Windows

La méthode la plus simple : télécharger Ollama depuis le site officiel. La page Windows propose un installateur, mais aussi une commande PowerShell :

irm https://ollama.com/install.ps1 | iex

Pour un débutant, le plus simple reste de cliquer sur Download for Windows, puis de lancer l’installateur. Une fois installé, Ollama peut être utilisé depuis PowerShell, Windows Terminal ou l’invite de commandes.

Étape 2 — Vérifier que Ollama fonctionne

Ouvrez PowerShell ou Windows Terminal, puis tapez :

ollama --version

Si Ollama est bien installé, Windows affiche une version ou répond sans erreur.

Étape 3 — Télécharger et lancer un premier modèle

La commande run télécharge un modèle s’il n’est pas présent, puis le lance :

ollama run gemma3

Au premier lancement, Ollama télécharge le modèle (cela peut prendre du temps). Ensuite, écrivez directement vos questions dans le terminal, par exemple :

Explique ce qu'est une IA locale en 5 lignes, avec des mots simples.

Quel modèle choisir pour commencer ?

Pour débuter, évitez les très gros modèles. Préférez un modèle compact, plus rapide à télécharger :

Profil Modèle à tester
Découverte TinyLlama, Phi, Gemma compact
Usage général Gemma, Qwen, Llama selon disponibilité
Code Qwen Coder, CodeLlama
Vision / image LLaVA ou modèle vision compatible
PC modeste Modèle 1B à 4B
PC confortable Modèle 7B à 14B

Étapes 4 et 5 — Lister et supprimer des modèles

Pour voir les modèles présents sur votre PC :

ollama list

Pour supprimer un modèle devenu inutile (les fichiers peuvent être volumineux) :

ollama rm gemma3

Où Ollama stocke-t-il les modèles ?

Par défaut, dans le dossier utilisateur : %HOMEPATH%\.ollama. Si votre disque principal est presque plein, vous pouvez changer l’emplacement via la variable d’environnement OLLAMA_MODELS (à créer dans les variables d’environnement de l’utilisateur, puis relancer l’application). Les modèles IA peuvent vite remplir le disque C:.

Étape 6 — Utiliser Ollama via une API locale

Ollama expose aussi une API locale, disponible par défaut sur :

http://localhost:11434/api

Cela permet de connecter Ollama à des scripts, applications ou interfaces web. Exemple de requête PowerShell :

Invoke-WebRequest -method POST `
  -Body '{"model":"gemma3", "prompt":"Explique les PC IA simplement.", "stream": false}' `
  -uri http://localhost:11434/api/generate

Ollama peut-il utiliser le GPU ?

Oui, selon le matériel et les pilotes. Ollama documente le support NVIDIA, AMD Radeon et Apple Metal, et permet de contrôler l’usage de plusieurs GPU NVIDIA avec CUDA_VISIBLE_DEVICES. Sur Windows, les GPU NVIDIA restent souvent le choix le plus simple ; les GPU AMD peuvent fonctionner, mais la compatibilité dépend davantage des pilotes.

Que faire si Ollama est lent ?

Si les réponses sont lentes, le modèle est peut-être trop gros pour votre PC. Essayez de : choisir un modèle plus petit, fermer les applications inutiles, vérifier l’espace disque, utiliser un SSD, vérifier que le GPU est bien sollicité, brancher le PC portable au secteur, ou passer à 32 Go de RAM. La règle : plus le modèle est gros, plus il demande de mémoire et de VRAM.

À retenir

Ollama est l’un des meilleurs outils pour lancer une IA locale sur Windows : léger, rapide, et très pratique dès qu’on veut dépasser le simple test. Un peu moins « grand public » que LM Studio car il repose sur le terminal, mais c’est aussi sa force. Pour une expérience visuelle proche de ChatGPT, associez-le ensuite à une interface comme Open WebUI. Et pour la vue d’ensemble tous systèmes, retrouvez notre guide complet Ollama.

FAQ

Ollama fonctionne-t-il sur Windows ?

Oui. La page officielle indique que la version Windows nécessite Windows 10 ou plus récent.

Faut-il savoir coder pour utiliser Ollama ?

Non, mais il faut accepter d’utiliser quelques commandes dans PowerShell ou Windows Terminal.

Ollama peut-il fonctionner hors ligne ?

Oui, pour les modèles déjà installés localement. Le téléchargement initial des modèles nécessite toutefois une connexion Internet.

Ollama utilise-t-il une API locale ?

Oui. L’API locale d’Ollama est servie par défaut sur http://localhost:11434/api.

techpi avatar Albert
Albert

Journaliste tech depuis 2013, je suis Albert et je décrypte l'actualité high-tech pour la rendre claire et utile au quotidien. Spécialisé dans le hardware, les objets connectés et le gaming, je teste également les logiciels et les outils d'intelligence artificielle qui changent nos usages. Aussi fasciné par l'écosystème Apple que par les configurations PC les plus underground. Passé par plusieurs rédactions de référence comme MacPlus et Phonandroid, je mets cette expérience au service de tests transparents, impartiaux et ancrés dans un usage 100 % réel.
Contactez : contact@techpi.fr

Articles: 551