◆ IA Locale — Ton ChatGPT privé et gratuit, sur ta machine, en 1 h · 24 € · ou tous les kits 49 € →

Suivi des prix · relevé du 28 septembre 2026

Prix des cartes graphiques pour l'IA locale

18 cartes graphiques suivies deux fois par semaine chez Materiel.net, comparées sur ce qui compte pour faire tourner un LLM : la mémoire vidéo, la bande passante et le prix du Go.

Les repères du 28 septembre

Relevé du lundi 28 septembre 2026 · prochain relevé : jeudi 1er octobre.

Go de VRAM le moins cher33 €/GoIntel Arc Pro B60 · 24 Go à 799,95 €
Plus de vitesse par euro8,1 tok/sIntel Arc B580 · pour 100 €, sur un 14B
24 Go et plus au meilleur prix799,95 €Intel Arc Pro B60 · 24 Go
32 Go au meilleur prix1 499,95 €Intel Arc Pro B65 · 32 Go

Toutes les cartes suivies

Prix le plus bas chez Materiel.net parmi les cartes en stock ou expédiées sous 7 jours, toutes marques confondues. Cliquez sur le nom d'une carte pour voir les modèles qu'elle fait tourner.

Trier par :
CartePrix le plus basMémoirePrix du GoVitesse estimée · bande passanteDepuis le relevé précédentAcheter
Intel Arc B580Intel · 1 carte en stock 429,95 € 12 Go 36 € ≈ 35 tok/s456 Go/s · 8,1 pour 100 € —
Radeon RX 9070 GREAMD · 1 carte en stock 699,95 € 12 Go 58 € ≈ 34 tok/s432 Go/s · 4,9 pour 100 € —
Radeon RX 9060 XT 16 GoAMD · 9 cartes en stock 799,95 € 16 Go 50 € ≈ 25 tok/s322 Go/s · 3,1 pour 100 € —
Intel Arc Pro B60Intel · 1 carte en stock 799,95 € 24 Go 33 € ≈ 35 tok/s456 Go/s · 4,4 pour 100 € —
RTX 5060 Ti 16 GoNVIDIA · 8 cartes en stock 819,95 € 16 Go 51 € ≈ 35 tok/s448 Go/s · 4,3 pour 100 € —
RTX 5070NVIDIA · 7 cartes en stock 949,95 € 12 Go 79 € ≈ 52 tok/s672 Go/s · 5,5 pour 100 € —
Radeon RX 9070AMD · 3 cartes en stock 999,95 € 16 Go 62 € ≈ 50 tok/s644 Go/s · 5,0 pour 100 € —
Radeon RX 9070 XTAMD · 11 cartes en stock 1 069,95 € 16 Go 67 € ≈ 50 tok/s644 Go/s · 4,7 pour 100 € —
RTX 5070 TiNVIDIA · 14 cartes en stock 1 399,95 € 16 Go 87 € ≈ 70 tok/s896 Go/s · 5,0 pour 100 € —
Intel Arc Pro B65Intel · 1 carte en stock 1 499,95 € 32 Go 47 € ≈ 47 tok/s608 Go/s · 3,1 pour 100 € —
RTX 5080NVIDIA · 19 cartes en stock 1 849,95 € 16 Go 116 € ≈ 75 tok/s960 Go/s · 4,1 pour 100 € —
Intel Arc Pro B70Intel · 1 carte en stock 1 899,95 € 32 Go 59 € ≈ 47 tok/s608 Go/s · 2,5 pour 100 € —
Radeon AI PRO R9700AMD · 1 carte en stock 2 199,95 € 32 Go 69 € ≈ 50 tok/s640 Go/s · 2,3 pour 100 € —
Radeon Pro W7800AMD · 1 carte en stock 2 599,95 € 32 Go 81 € ≈ 45 tok/s576 Go/s · 1,7 pour 100 € —
RTX PRO 4000 BlackwellNVIDIA · 1 carte en stock 3 768,95 € 24 Go 157 € ≈ 52 tok/s672 Go/s · 1,4 pour 100 € —
RTX 5090NVIDIA · 8 cartes en stock 5 699,95 € 32 Go 178 € ≈ 139 tok/s1 792 Go/s · 2,4 pour 100 € —
RTX PRO 5000 Blackwell 48 GoNVIDIA · 2 cartes en stock 9 899,95 € 48 Go 206 € ≈ 105 tok/s1 344 Go/s · 1,1 pour 100 € —
RTX PRO 5000 Blackwell 72 GoNVIDIA · 1 carte en stock 10 439,95 € 72 Go 145 € ≈ 105 tok/s1 344 Go/s · 1,0 pour 100 € —

Vitesse estimée : environ 70 % du plafond théorique (bande passante ÷ taille du modèle) pour un modèle de 14 milliards de paramètres en Q4. Amazon : prix affiché en direct sur le bouton. Liens affiliés — commission versée par le marchand, sans surcoût pour vous ; le tableau est calculé automatiquement.

Ce que chaque quantité de VRAM permet

Les modèles les plus gros et les plus récents du catalogue qui tiennent en Q4 avec un contexte de 8K, et la carte la moins chère qui offre au moins cette mémoire au dernier relevé. Pour un calcul précis, utilisez le calculateur de VRAM ou le configurateur.

VRAMModèles qui tiennent (Q4)Carte la moins chère
12 GoNemotron 3 Super 12B, Gemma 4 12BIntel Arc B580 429,95 €
16 GoDevstral Small 2 24B, LFM2 24BRadeon RX 9060 XT 16 Go 799,95 €
24 GoQwen 3.6 35B-A3B, Laguna XS.2Intel Arc Pro B60 799,95 €
32 GoQwen 3.6 35B-A3B, Laguna XS.2Intel Arc Pro B65 1 499,95 €
48 GoNemotron 3 Puzzle 75B-A9B, LongCat Flash Lite Sparse 69B-A3BRTX PRO 5000 Blackwell 48 Go 9 899,95 €
72 GoLaguna S 2.1, Qwen3-Coder-Next 80B-A3BRTX PRO 5000 Blackwell 72 Go 10 439,95 €

Évolution des prix

Le suivi a commencé le 28 septembre 2026 : l'évolution de chaque carte s'affichera ici dès le prochain relevé, jeudi 1er octobre.

Les prix Amazon ne sont pas archivés : Amazon n'autorise que l'affichage de prix récents. Sur Mac, la mémoire unifiée change la donne : voir quel LLM pour mon Mac.

Questions fréquentes

Quelle carte graphique acheter pour faire tourner un LLM en local ?

Regardez d'abord la mémoire vidéo (VRAM) : le modèle doit y tenir entièrement, sinon il déborde sur la mémoire du PC et la vitesse s'effondre. En Q4, 12 Go suffisent pour les modèles jusqu'à environ 14 milliards de paramètres, 16 Go jusqu'à environ 24 milliards, 24 à 32 Go pour les modèles de 30 à 35 milliards, 48 Go jusqu'à environ 70 milliards. À mémoire égale, la bande passante départage : elle fixe la vitesse de génération.

NVIDIA, AMD ou Intel pour l'IA locale ?

NVIDIA reste le choix le plus simple : CUDA est pris en charge par tous les outils (Ollama, LM Studio, llama.cpp, vLLM). Les Radeon RX 9000 et AI PRO R9700 sont prises en charge par Ollama (ROCm 7), LM Studio et llama.cpp, avec parfois un peu plus de réglages. Les Intel Arc passent surtout par Vulkan ou SYCL (llama.cpp, LM Studio) et OpenVINO : c'est souvent la VRAM la moins chère, mais l'écosystème le moins mûr.

La RTX 5090 vaut-elle son prix pour l'IA ?

C'est la carte grand public la plus rapide (1 792 Go/s) avec 32 Go, mais elle coûte 5 699,95 € au dernier relevé, contre 2 349 € à son lancement. Pour 32 Go, une Radeon AI PRO R9700 (2 199,95 €) ou une Intel Arc Pro B70 (1 899,95 €) coûte bien moins cher, pour une vitesse environ 2,8 fois plus faible. Pour les très gros modèles, un mini-PC à 128 Go de mémoire unifiée reste l'alternative.

D'où viennent ces prix et quand sont-ils mis à jour ?

Du flux produit de Materiel.net, notre partenaire, relevé automatiquement chaque lundi et chaque jeudi. Pour chaque puce, nous retenons la carte la moins chère en stock ou expédiée sous 7 jours, toutes marques confondues. Les prix Amazon ne sont pas archivés : Amazon n'autorise que l'affichage de prix récents, ils apparaissent donc en direct sur les boutons. Les liens sont affiliés : un achat nous rapporte une commission, sans surcoût pour vous, et n'influence pas le classement, calculé automatiquement.

Comment est estimée la vitesse ?

Pour générer chaque token, la carte relit tout le modèle en mémoire : la vitesse maximale vaut à peu près la bande passante divisée par la taille du modèle. Nous en retenons 70 %, pour un modèle de 14 milliards de paramètres en Q4 (environ 9 Go). Les mesures réelles varient selon le logiciel et les pilotes : c'est un ordre de grandeur pour comparer les cartes, pas une promesse.

Plus d'outils gratuits