Cornerstone · hardware · 2026
Quel PC et GPU pour l'IA locale en 2026 ? Guide par profil
Six pages minces « profil matériel » ne servaient personne. Voici un seul guide par profil : 16 Go RAM, portable, CPU only, GTX 1080 Ti, RTX 3060 12 Go — avec paliers VRAM et la règle OutilsIA : mesurer avant d'acheter.
Par Chris Drakkeng · 6 août 2026 · fusion reconquête SEO · sans affiliation
- 12 Go VRAM = premier vrai ticket CUDA ; 16 Go = confort ; 24 Go = 32B quantifiés.
- CPU only / 16 Go RAM sans GPU = découverte, pas usage quotidien fluide.
- GTX 1080 Ti = encore utile pour apprendre, pas pour viser le confort 2026.
- Mesure publique OutilsIA : 118,5 tok/s Hermes 3 8B sur 4080 SUPER (27/07/2026) — détail.
- Outil : Local Cockpit · estimateur : Mon PC peut-il ?
1. Règle d'or
Ne partez pas d'une fiche Amazon. Partez du blocage mesuré : VRAM, RAM, runtime Ollama, stockage, thermique. Beaucoup de PC « déjà là » suffisent pour le volume quotidien (7–8B). Le forfait cloud reste rationnel pour les longues sessions agentiques — voir Qwen coder vs Claude Code.
2. Tableau des paliers
| Profil | Ce que ça permet | Limite principale | Upgrade utile ? |
|---|---|---|---|
| CPU only / 0 Go VRAM | Découvrir Ollama, petits modèles | Lenteur, petits contextes | GPU 12 Go si usage réel |
| 16 Go RAM, peu/pas GPU | Chat léger, embeddings | Pas d'agentique confortable | RAM 32 Go ou GPU selon scan |
| Portable gaming 6–8 Go VRAM | 7B Q4, labo | Chaleur, batterie, VRAM | Souvent rien — ajuster modèle |
| GTX 1080 Ti 11 Go | Apprendre CUDA, 7–8B | Architecture vieillissante | Seulement si usage > jouet |
| RTX 3060 12 Go | Meilleur ticket d'entrée | 14B/32B limités | 16–24 Go si besoin mesuré |
| 16 Go VRAM (4070/4080 class) | Confort + mesure type Hermes 8B fluide | 32B selon quantif | Souvent aucun achat urgent |
| 24 Go+ (3090/4090) | 32B Q4, contextes longs | Prix, bruit, alim | SSD/ventil avant dual GPU |
Profil A — CPU only
Utile pour comprendre la stack (Ollama, prompts, RAG léger). Models d'entrée : Phi mini, Gemma 2B, Qwen 0.5–1.5B. Ne vous jugez pas sur la vitesse : le goulet est l'absence de VRAM. Si vous codez tous les jours avec un LLM, prévoyez un GPU 12 Go plutôt qu'un énième upgrade RAM seul.
Profil B — 16 Go RAM (desktop ou portable)
16 Go système + peu de VRAM = machine « bureautique + découverte IA ». Passez d'abord par le scan : parfois le blocage n'est pas la RAM mais le modèle trop gros. Objectif raisonnable : 32 Go RAM si vous gardez navigateur + IDE + Ollama ouverts.
Profil C — PC portable
Priorité : thermique et autonomie. Un portable 8 Go VRAM peut faire du 7B en Q4, mais bruyant et chaud. Pour le voyage : petits modèles + cloud en secours. Pour le bureau : un desktop 3060/4070 bat souvent le portable « gaming IA » en confort/€.
Profil D — GTX 1080 Ti (11 Go)
Encore une bonne carte pour apprendre CUDA et faire tourner des 7–8B quantifiés. Ce n'est plus le sweet spot 2026 pour le confort agentique. Si elle est déjà dans le boîtier : exploitez-la. Si vous achetez d'occasion « pour l'IA » : regardez plutôt 3060 12 Go / 16 Go moderne selon budget mesuré.
Profil E — RTX 3060 12 Go (ticket d'entrée)
Le palier le plus cité pour démarrer sérieusement : Qwen/Hermes 7–8B, Mistral 7B, embeddings locaux, certains 14B en Q4. Les 32B restent inconfortables. Avant d'upgrader vers 24 Go, mesurez si vous utilisez vraiment la 3060 à fond.
Profil F — 16 à 24 Go VRAM
Zone de confort OutilsIA. Sur notre banc RTX 4080 SUPER 16 Go, Hermes 3 8B a affiché 118,5 tok/s le 27/07/2026 (Ollama Windows) — preuve : /nos-mesures-reelles. À 24 Go (3090/4090), les 32B Q4 deviennent réalistes. Verdict fréquent après scan : aucun achat urgent.
3. Runtime : Windows vs WSL (Ollama)
Les anciennes pages « Ollama Windows vs WSL » renvoyaient ici pour le matériel. Côté runtime : Windows natif et WSL se comportent différemment (chemins, GPU passthrough, perfs). Identifiez le runtime exact dans Local Cockpit avant de comparer des tokens/s. Guide install : installer Ollama.
4. Processus de décision en 10 minutes
- Ouvrir Mon PC peut-il ? (estimateur) ou installer Local Cockpit.
- Noter VRAM libre, RAM, Ollama, modèle qui charge.
- Lancer un bench court → tok/s + durée.
- Comparer au tableau des paliers (section 2).
- Acheter seulement si le scan montre un goulet (VRAM/RAM/stockage), pas par FOMO.
FAQ
Combien de VRAM pour l'IA locale en 2026 ?
8 Go découverte · 12 Go ticket d'entrée · 16 Go confort · 24 Go+ pour 32B quantifiés. Mesurez plutôt que de croire une fiche.
Un PC sans GPU peut-il faire de l'IA locale ?
Oui pour découvrir, non pour un usage quotidien fluide. Le blocage principal est l'absence de VRAM dédiée.
Faut-il acheter avant de mesurer ?
Non. Scan d'abord. Notre mesure 4080 SUPER du 27/07 a conclu « aucun achat urgent » sur cette machine.
Sources
- Nos mesures réelles · Preuves Local Cockpit
- Comment nous testons · Exemples de rapports
- Meilleur GPU IA locale · Arrangement suffisant
- Pages profil fusionnées (301) : 16 Go RAM, portable, CPU only, 1080 Ti, 3060 12 Go.
Chris Drakkeng — OutilsIA. Pas d'affiliation Amazon sur ce guide.