Suivi des prix · relevé du 28 septembre 2026
Prix des cartes graphiques pour l'IA locale
18 cartes graphiques suivies deux fois par semaine chez Materiel.net, comparées sur ce qui compte pour faire tourner un LLM : la mémoire vidéo, la bande passante et le prix du Go.
Les repères du 28 septembre
Relevé du lundi 28 septembre 2026 · prochain relevé : jeudi 1er octobre.
Toutes les cartes suivies
Prix le plus bas chez Materiel.net parmi les cartes en stock ou expédiées sous 7 jours, toutes marques confondues. Cliquez sur le nom d'une carte pour voir les modèles qu'elle fait tourner.
| Carte | Prix le plus bas | Mémoire | Prix du Go | Vitesse estimée · bande passante | Depuis le relevé précédent | Acheter |
|---|---|---|---|---|---|---|
| Intel Arc B580Intel · 1 carte en stock | 429,95 € | 12 Go | 36 € | ≈ 35 tok/s456 Go/s · 8,1 pour 100 € | — | |
| Radeon RX 9070 GREAMD · 1 carte en stock | 699,95 € | 12 Go | 58 € | ≈ 34 tok/s432 Go/s · 4,9 pour 100 € | — | |
| Radeon RX 9060 XT 16 GoAMD · 9 cartes en stock | 799,95 € | 16 Go | 50 € | ≈ 25 tok/s322 Go/s · 3,1 pour 100 € | — | |
| Intel Arc Pro B60Intel · 1 carte en stock | 799,95 € | 24 Go | 33 € | ≈ 35 tok/s456 Go/s · 4,4 pour 100 € | — | |
| RTX 5060 Ti 16 GoNVIDIA · 8 cartes en stock | 819,95 € | 16 Go | 51 € | ≈ 35 tok/s448 Go/s · 4,3 pour 100 € | — | |
| RTX 5070NVIDIA · 7 cartes en stock | 949,95 € | 12 Go | 79 € | ≈ 52 tok/s672 Go/s · 5,5 pour 100 € | — | |
| Radeon RX 9070AMD · 3 cartes en stock | 999,95 € | 16 Go | 62 € | ≈ 50 tok/s644 Go/s · 5,0 pour 100 € | — | |
| Radeon RX 9070 XTAMD · 11 cartes en stock | 1 069,95 € | 16 Go | 67 € | ≈ 50 tok/s644 Go/s · 4,7 pour 100 € | — | |
| RTX 5070 TiNVIDIA · 14 cartes en stock | 1 399,95 € | 16 Go | 87 € | ≈ 70 tok/s896 Go/s · 5,0 pour 100 € | — | |
| Intel Arc Pro B65Intel · 1 carte en stock | 1 499,95 € | 32 Go | 47 € | ≈ 47 tok/s608 Go/s · 3,1 pour 100 € | — | |
| RTX 5080NVIDIA · 19 cartes en stock | 1 849,95 € | 16 Go | 116 € | ≈ 75 tok/s960 Go/s · 4,1 pour 100 € | — | |
| Intel Arc Pro B70Intel · 1 carte en stock | 1 899,95 € | 32 Go | 59 € | ≈ 47 tok/s608 Go/s · 2,5 pour 100 € | — | |
| Radeon AI PRO R9700AMD · 1 carte en stock | 2 199,95 € | 32 Go | 69 € | ≈ 50 tok/s640 Go/s · 2,3 pour 100 € | — | |
| Radeon Pro W7800AMD · 1 carte en stock | 2 599,95 € | 32 Go | 81 € | ≈ 45 tok/s576 Go/s · 1,7 pour 100 € | — | |
| RTX PRO 4000 BlackwellNVIDIA · 1 carte en stock | 3 768,95 € | 24 Go | 157 € | ≈ 52 tok/s672 Go/s · 1,4 pour 100 € | — | |
| RTX 5090NVIDIA · 8 cartes en stock | 5 699,95 € | 32 Go | 178 € | ≈ 139 tok/s1 792 Go/s · 2,4 pour 100 € | — | |
| RTX PRO 5000 Blackwell 48 GoNVIDIA · 2 cartes en stock | 9 899,95 € | 48 Go | 206 € | ≈ 105 tok/s1 344 Go/s · 1,1 pour 100 € | — | |
| RTX PRO 5000 Blackwell 72 GoNVIDIA · 1 carte en stock | 10 439,95 € | 72 Go | 145 € | ≈ 105 tok/s1 344 Go/s · 1,0 pour 100 € | — |
Vitesse estimée : environ 70 % du plafond théorique (bande passante ÷ taille du modèle) pour un modèle de 14 milliards de paramètres en Q4. Amazon : prix affiché en direct sur le bouton. Liens affiliés — commission versée par le marchand, sans surcoût pour vous ; le tableau est calculé automatiquement.
Ce que chaque quantité de VRAM permet
Les modèles les plus gros et les plus récents du catalogue qui tiennent en Q4 avec un contexte de 8K, et la carte la moins chère qui offre au moins cette mémoire au dernier relevé. Pour un calcul précis, utilisez le calculateur de VRAM ou le configurateur.
| VRAM | Modèles qui tiennent (Q4) | Carte la moins chère |
|---|---|---|
| 12 Go | Nemotron 3 Super 12B, Gemma 4 12B | Intel Arc B580 429,95 € |
| 16 Go | Devstral Small 2 24B, LFM2 24B | Radeon RX 9060 XT 16 Go 799,95 € |
| 24 Go | Qwen 3.6 35B-A3B, Laguna XS.2 | Intel Arc Pro B60 799,95 € |
| 32 Go | Qwen 3.6 35B-A3B, Laguna XS.2 | Intel Arc Pro B65 1 499,95 € |
| 48 Go | Nemotron 3 Puzzle 75B-A9B, LongCat Flash Lite Sparse 69B-A3B | RTX PRO 5000 Blackwell 48 Go 9 899,95 € |
| 72 Go | Laguna S 2.1, Qwen3-Coder-Next 80B-A3B | RTX PRO 5000 Blackwell 72 Go 10 439,95 € |
Évolution des prix
Le suivi a commencé le 28 septembre 2026 : l'évolution de chaque carte s'affichera ici dès le prochain relevé, jeudi 1er octobre.
Les prix Amazon ne sont pas archivés : Amazon n'autorise que l'affichage de prix récents. Sur Mac, la mémoire unifiée change la donne : voir quel LLM pour mon Mac.
Questions fréquentes
Quelle carte graphique acheter pour faire tourner un LLM en local ?
Regardez d'abord la mémoire vidéo (VRAM) : le modèle doit y tenir entièrement, sinon il déborde sur la mémoire du PC et la vitesse s'effondre. En Q4, 12 Go suffisent pour les modèles jusqu'à environ 14 milliards de paramètres, 16 Go jusqu'à environ 24 milliards, 24 à 32 Go pour les modèles de 30 à 35 milliards, 48 Go jusqu'à environ 70 milliards. À mémoire égale, la bande passante départage : elle fixe la vitesse de génération.
NVIDIA, AMD ou Intel pour l'IA locale ?
NVIDIA reste le choix le plus simple : CUDA est pris en charge par tous les outils (Ollama, LM Studio, llama.cpp, vLLM). Les Radeon RX 9000 et AI PRO R9700 sont prises en charge par Ollama (ROCm 7), LM Studio et llama.cpp, avec parfois un peu plus de réglages. Les Intel Arc passent surtout par Vulkan ou SYCL (llama.cpp, LM Studio) et OpenVINO : c'est souvent la VRAM la moins chère, mais l'écosystème le moins mûr.
La RTX 5090 vaut-elle son prix pour l'IA ?
C'est la carte grand public la plus rapide (1 792 Go/s) avec 32 Go, mais elle coûte 5 699,95 € au dernier relevé, contre 2 349 € à son lancement. Pour 32 Go, une Radeon AI PRO R9700 (2 199,95 €) ou une Intel Arc Pro B70 (1 899,95 €) coûte bien moins cher, pour une vitesse environ 2,8 fois plus faible. Pour les très gros modèles, un mini-PC à 128 Go de mémoire unifiée reste l'alternative.
D'où viennent ces prix et quand sont-ils mis à jour ?
Du flux produit de Materiel.net, notre partenaire, relevé automatiquement chaque lundi et chaque jeudi. Pour chaque puce, nous retenons la carte la moins chère en stock ou expédiée sous 7 jours, toutes marques confondues. Les prix Amazon ne sont pas archivés : Amazon n'autorise que l'affichage de prix récents, ils apparaissent donc en direct sur les boutons. Les liens sont affiliés : un achat nous rapporte une commission, sans surcoût pour vous, et n'influence pas le classement, calculé automatiquement.
Comment est estimée la vitesse ?
Pour générer chaque token, la carte relit tout le modèle en mémoire : la vitesse maximale vaut à peu près la bande passante divisée par la taille du modèle. Nous en retenons 70 %, pour un modèle de 14 milliards de paramètres en Q4 (environ 9 Go). Les mesures réelles varient selon le logiciel et les pilotes : c'est un ordre de grandeur pour comparer les cartes, pas une promesse.