
IA en local : faire tourner une intelligence artificielle
sur son propre ordinateur
Guides d’installation · Configurations · Modèles · Windows, macOS et Linux
🕒 Dernière mise à jour : 15 août 2026
Faire tourner une IA en local, c’est exécuter un modèle de langage directement sur votre machine, sans cloud, sans abonnement et sans envoyer vos données à un serveur. Cette page regroupe tout ce qu’il faut : le matériel nécessaire, les logiciels (Ollama, LM Studio), les modèles à choisir et le coût réel comparé à un abonnement.
Qu’est-ce qu’une IA en local ?
Une IA en local est un modèle de langage (LLM) téléchargé sur votre disque dur et exécuté par votre processeur ou votre carte graphique. Contrairement à ChatGPT, Gemini ou Claude, rien ne transite par Internet : vos documents, vos prompts et vos réponses restent sur votre machine. Le modèle fonctionne même hors connexion.
La contrepartie est mécanique : la qualité et la vitesse dépendent entièrement de votre matériel. Un modèle de 8 milliards de paramètres tourne confortablement sur un PC récent ; un modèle de 70 milliards demande une configuration sérieuse. C’est tout l’objet de cette page : vous aider à trouver le point d’équilibre entre votre machine, vos besoins et votre budget.
L’IA en local : l’essentiel
Coût logiciel
Gratuit
RAM minimum
16 Go (32 Go conseillés)
GPU
Utile, pas obligatoire
Logiciels de référence
Ollama, LM Studio
Systèmes
Windows, macOS, Linux
Confidentialité
100 % hors ligne
Par où commencer ?
Trois étapes suffisent pour avoir une IA fonctionnelle sur votre machine en moins de vingt minutes. Suivez-les dans l’ordre.
01
Vérifier sa machine
Comptez votre RAM et repérez votre carte graphique. En dessous de 16 Go, restez sur de petits modèles. Un Mac Apple Silicon s’en sort très bien grâce à sa mémoire unifiée.
02
Installer un logiciel
LM Studio pour une interface graphique clé en main, Ollama si vous êtes à l’aise avec le terminal. Les deux sont gratuits et fonctionnent sur les trois systèmes.
03
Télécharger un modèle
Commencez par un modèle de 7 à 8 milliards de paramètres en version quantifiée. Si la vitesse vous convient, montez en gamme ensuite.
Quel matériel pour faire tourner une IA en local ?
La règle est simple : c’est la mémoire qui commande. Un modèle doit tenir entièrement en VRAM (mémoire de la carte graphique) pour tourner vite. S’il déborde, il bascule sur la RAM système et la vitesse s’effondre. Voici les paliers à connaître.
| VRAM disponible | Taille de modèle | Exemples de cartes | Usage réaliste |
|---|---|---|---|
| 8 Go | 7 à 8 milliards | RTX 4060, RTX 5060 | Rédaction, résumé, questions simples |
| 12 à 16 Go | 13 à 14 milliards | RTX 5070, RTX 5070 Ti | Code, analyse de documents |
| 24 Go | 32 milliards | RTX 5080, RTX 3090 | Raisonnement, contextes longs |
| 32 Go et plus | 70 milliards | RTX 5090 | Proche des modèles cloud d’entrée de gamme |
| Mac Apple Silicon | Selon mémoire unifiée | M4 / M5 à partir de 24 Go | Excellent rapport performance / silence |
Peut-on se passer de carte graphique ?
Oui, mais avec des attentes ajustées. Sur un processeur seul, un modèle de 7 milliards de paramètres génère quelques mots par seconde : suffisant pour de la rédaction, frustrant pour une conversation. Les NPU intégrés aux processeurs récents accélèrent certaines tâches, sans remplacer un GPU pour l’instant.
Ollama ou LM Studio : quel logiciel choisir ?
Ce sont les deux portes d’entrée de l’IA locale. Tous les deux gratuits, tous les deux compatibles Windows, macOS et Linux. La différence tient surtout à l’interface.
Le plus simple
LM Studio
- Interface graphique complète, aucune ligne de commande.
- Catalogue de modèles intégré avec indication de compatibilité.
- Idéal pour un premier essai et pour discuter avec ses documents.
- Plus lourd qu’Ollama en ressources.
Le plus léger
Ollama
- Fonctionne en arrière-plan, très économe en ressources.
- Une commande suffit pour lancer un modèle.
- API locale : se branche à d’autres applications et agents.
- Demande d’être à l’aise avec le terminal.
Sur Windows en particulier, notre guide pas à pas : lancer une IA locale avec Ollama sur Windows. Et pour l’IA française : installer Mistral AI en local.
Quel modèle d’IA installer ?
Le choix du modèle compte autant que le matériel. Un petit modèle récent et bien entraîné bat souvent un gros modèle vieux d’un an. Trois familles se dégagent selon l’usage : la conversation générale, le code et le raisonnement.
- Usage général : un modèle de 7 à 14 milliards de paramètres couvre la rédaction, la traduction, le résumé et les questions courantes.
- Code : privilégiez un modèle spécialisé, nettement plus fiable qu’un généraliste de taille équivalente.
- Documents confidentiels : c’est le cas d’usage où l’IA locale bat le cloud sans discussion, puisque rien ne sort de votre machine.
- Quantification : préférez une version 4 bits, deux à trois fois plus légère pour une perte de qualité souvent imperceptible.
- Sur smartphone : c’est possible, avec des modèles réduits et des attentes revues à la baisse.
Notre sélection détaillée et mise à jour se trouve dans le comparatif des meilleurs modèles IA en local, complété par notre comparatif des IA locales. Pour le mobile, voir installer une IA locale sur Android et iOS. Pour la génération d’images, c’est par ici : quel PC pour Stable Diffusion en local.
Combien ça coûte par rapport à un abonnement ?
Le logiciel et les modèles sont gratuits : le coût réel, c’est le matériel et l’électricité. Face à un abonnement mensuel type ChatGPT Plus, le calcul dépend surtout de la carte graphique dont vous disposez déjà. Si vous devez acheter un GPU dédié uniquement pour ça, l’amortissement se compte en années. Si vous avez déjà une machine de jeu récente, l’IA locale ne vous coûte quasiment rien.
Nous avons détaillé le calcul complet, électricité comprise, dans IA locale contre ChatGPT Plus : combien ça coûte vraiment.
À lire aussi
Pour aller plus loin, consultez notre rubrique intelligence artificielle, nos tutoriels, nos guides d’achat et nos tests produits. Sur des usages plus avancés : démarrer avec Claude Code, le vibe coding et monter un home lab.
Questions fréquentes sur l’IA en local
Faut-il une carte graphique pour faire tourner une IA en local ?
Non, mais elle change tout sur la vitesse. Sans GPU, un modèle de 7 milliards de paramètres reste utilisable pour de la rédaction ou du résumé. Avec une carte disposant de 8 Go de VRAM ou plus, les réponses arrivent en temps réel.
Une IA en local est-elle gratuite ?
Oui. Ollama, LM Studio et la grande majorité des modèles open source sont gratuits, sans abonnement ni limite d’utilisation. Le seul coût est celui du matériel et de la consommation électrique.
Une IA locale vaut-elle ChatGPT ou Claude ?
Pas au même niveau. Les meilleurs modèles locaux exécutables sur une machine grand public se situent en dessous des modèles cloud les plus récents. En revanche, ils sont largement suffisants pour la rédaction, la traduction, le résumé et l’analyse de documents, avec l’avantage décisif de la confidentialité.
Mes données restent-elles vraiment privées ?
Oui, dès lors que le modèle est téléchargé. L’exécution se fait entièrement sur votre machine : aucun prompt, aucun document et aucune réponse n’est envoyé sur Internet. Vous pouvez même couper votre connexion et continuer à l’utiliser.
Combien de RAM faut-il pour une IA en local ?
16 Go constituent le minimum confortable pour des modèles de 7 à 8 milliards de paramètres. 32 Go ouvrent la porte aux modèles de 13 à 14 milliards et au multitâche. 64 Go ne se justifient que pour les très gros modèles ou un usage professionnel.
Quelle est la différence entre Ollama et LM Studio ?
LM Studio propose une interface graphique complète, adaptée aux débutants. Ollama fonctionne en ligne de commande et en arrière-plan, avec une API locale qui permet de le connecter à d’autres applications. Les deux peuvent cohabiter sur la même machine.
Peut-on faire tourner une IA en local sur un Mac ?
Oui, et c’est même l’une des meilleures options. La mémoire unifiée des puces Apple Silicon est partagée entre le processeur et le GPU, ce qui permet de charger des modèles plus gros qu’avec une carte graphique de VRAM équivalente. Un Mac à partir de 24 Go de mémoire est très à l’aise.
Peut-on utiliser une IA en local sans connexion Internet ?
Oui. La connexion n’est nécessaire qu’une fois, pour télécharger le logiciel et le modèle. Ensuite, tout fonctionne hors ligne.




