Intermédiaire 18 minBuild

Config PC IA : budget 32 GB VRAM

Vous voulez une machine capable de faire tourner Qwen3-Coder 30B-A3B en pleine qualité (Q8), un généraliste comme Qwen 3.6 35B-A3B ou Qwen 3.8 27B sans compromis, et d'indexer sérieusement des RAG de plusieurs Go. L'objectif : 32 Go de VRAM effective pour 2500 € — un budget tendu mais faisable. Ce guide détaille les composants, les arbitrages et les erreurs à ne pas commettre.

Par Mohamed Meguedmi·Màj 2026-08-27·Testé sur Windows, macOS, Linux

#L'objectif : 32 Go VRAM pour 2500 €

32 Go, c'est le seuil au-dessus duquel vous pouvez tourner un Qwen3-Coder 30B-A3B en Q8 (≈32 Go, pleine qualité) avec un contexte confortable, un Qwen 3.6 35B-A3B (MoE, 23 Go) avec de la marge, ou deux modèles en parallèle. Ça ouvre la bibliothèque 2026.

Chemin simple vs chemin économique
Simple : une RTX 5090 32 Go (neuve 2500 € à elle seule). Économique : deux RTX 3090 24 Go d'occasion en parallèle (1400 € pour 48 Go effectifs). Le reste du guide couvre les deux voies.

#1. GPU : la pièce maîtresse

#Option A — RTX 5090 32 Go (simple)

Prix
~2500 € neuf (bouge selon dispo).
VRAM
32 Go GDDR7. Un seul GPU, pas de config multi à faire.
Conso
575 W TBP. Exige une alim 1000 W minimum.
Idéal pour
Single-user, un seul gros modèle (Qwen 3.6 35B-A3B, ou Qwen3-Coder 30B-A3B en Q8 ≈32 Go), fine-tuning limité.

#Option B — 2× RTX 3090 24 Go (économique, 48 Go effectifs)

Prix
~1400 € d'occasion (~700 € pièce). Vérifiez bien l'état thermique.
VRAM
48 Go combinés via tensor parallel (vLLM, ExLlamaV2, llama.cpp split-mode).
Conso
2× 350 W = 700 W au max. Alim 1200 W+ obligatoire.
Idéal pour
Gros modèles 30B en pleine qualité (Q8) ou deux modèles en parallèle, serving multi-users via vLLM, fine-tuning LoRA.
Inconvénient
Complexité config multi-GPU, cartes massives (3 slots chacune), chaleur.

#2. CPU : ni pire ni meilleur

Le CPU joue peu pendant l'inférence GPU. Il compte surtout pour : charger les modèles (vitesse I/O), faire du chunking/embeddings si vous construisez un RAG, et gérer le reste de l'OS.

Ryzen 5 5600 / 5700X AM4 occasion (~100-170 €)
Parfait pour un build budget avec GPU d'occasion (RTX 3060 12 Go, 3090). Plateforme AM4 + DDR4 reste pertinente, économie plateforme ~200 € vs AM5.
Ryzen 5 7600 / Core i5-14400F (~180-220 €)
Entrée AM5 ou LGA 1700 neuve. 6 cœurs suffisent pour piloter une 4060/5060 ou une 3060. Le choix si vous visez un build neuf sobre.
Ryzen 7 9700X (~350 €)
8 cœurs, très bon rapport perf/prix. Largement suffisant pour la majorité des builds LLM.
Ryzen 9 9900X (~500 €)
12 cœurs si vous compilez aussi beaucoup, ou faites du batch CPU parallèle.
Intel Core Ultra 7 265K (~450 €)
Concurrent Intel. Bon en single-thread, conso maîtrisée.
i
Pas besoin du top CPU
Un Ryzen 5 suffit pour un build GPU d'occasion, un Ryzen 7 ou Core i7 pour le reste. Au-delà de 8 cœurs, le gain LLM est marginal. L'argent est mieux investi dans la VRAM.

#3. RAM système

32 Go DDR5 (~100 €)
Minimum. Tient l'OS + chargement/déchargement rapide des modèles.
64 Go DDR5 (~200 €)
Recommandé. Utile si vous faites tourner un backend LLM + un IDE + un navigateur + Docker simultanément.
128 Go (~450 €)
Pour les cas RAG lourds (millions de documents indexés en RAM), ou si vous offload un partie du modèle en CPU.
DDR5-6000 suffit
Pas besoin de RAM overclockée à 8000 MHz. Le gain LLM est imperceptible au-delà de 6000 MHz CL30.

#4. Stockage

SSD NVMe 2 To (~150 €)
Obligatoire. Les modèles pèsent 5-50 Go chacun. Lecture séquentielle 7 Go/s minimum pour un chargement rapide.
SSD secondaire 4 To (~300 €, optionnel)
Pour vos datasets RAG, sauvegardes, VM. Un SATA suffit.
Pas de HDD
Charger un 70B depuis un HDD = 5-10 minutes. Sur NVMe, 30 secondes.

#5. Alim

Option A (RTX 5090)
Corsair RM1000x ou Seasonic Prime TX-1000. 80+ Gold minimum, 1000 W. Câbles 12V-2x6 pour la 5090.
Option B (2× 3090)
Corsair AX1600i ou équivalent. 1600 W recommandé pour marge. Vérifiez que l'alim a 4× connecteurs PCIe 8-pin dédiés.
Économie
N'économisez pas ici. Une alim qui tombe peut griller GPU, CPU et carte mère ensemble.

#6. Boîtier & ventilation

Boîtier
Fractal Meshify 2 XL, Lian Li O11 Dynamic XL. Airflow d'abord, esthétique ensuite. 2× 3090 demandent beaucoup d'espace.
Watercooling CPU
Obligatoire pour Ryzen 9 / Core i9. 240 mm AIO minimum.
Ventilateurs
6-8 ventilos 140 mm en push-pull. Les 3090 chauffent énormément, ventilation en positif nécessaire.
Acoustique
Un PC LLM qui tourne en continu doit être supportable. Ventilos Noctua NF-A14 ou équivalents.

#Checklist achat

☐ CPU + carte mère compatibles
Socket AM5 pour Ryzen 9000, LGA 1851 pour Core Ultra.
☐ PCIe 5.0 x16
Pour la RTX 5090. PCIe 4.0 ne brime pas en LLM mais soyez cohérent.
☐ Alim ≥ 1000 W (A) ou 1600 W (B)
Avec les bons câbles GPU.
☐ Boîtier assez grand
Vérifiez compatibilité GPU (longueur, hauteur) et radiateur AIO.
☐ Ventilation généreuse
Plus de ventilos vaut mieux que des ventilos rapides.
☐ Stockage NVMe 2 To
Carte mère avec M.2 Gen 4 ou Gen 5.
☐ Budget OS
Windows Pro (~150 €) ou Linux gratuit. Linux gagne 10-15 % en perf LLM.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.