Accueil Catalogue Meilleur LLM sur Radeon RX 7900 XT (20 GB) en 2026

Meilleur LLM sur Radeon RX 7900 XT (20 GB) en 2026

Classement mis à jour le 18/08/2026

La Radeon RX 7900 XT (20 GB GDDR6, 800 Go/s) est la sœur cadette de la 7900 XTX. 20 Go inhabituels permettent les 24-32B en Q4 confortable. ~650 € neuve, excellent rapport.

Classement

1

🇨🇳 LLaDA 2.0 Uni 16B

Ant Group / inclusionAI · 16B paramètres · Apache 2.0 · 8 192 tokens ctx

Premier dLLM open Apache 2.0 : MoE 16B/1B + décodeur diffusion 6.2B. Texte+vision unifié. Sortie 22 avril 2026.

Pourquoi ce rang Premier dLLM open Apache 2.0 : MoE 16B/1B + décodeur diffusion 6.2B. Texte+vision unifié. Sortie 22 avril 2026.
# HuggingFace : inclusionAI/LLaDA2.0-Uni (Flash Attn 2 + CUDA 12.4 requis)
Sur Radeon RX 7900 XT
Q4_K_M
18 GB · 60 tok/s
2

🇫🇷 Devstral Small 2 24B

Mistral AI · 24B paramètres · Apache 2.0 · 256 000 tokens ctx

Spécialiste coding 24B Apache 2.0. 72.2% SWE-Bench. 256k ctx, FR lab.

Pourquoi ce rang Spécialiste coding 24B Apache 2.0. 72.2% SWE-Bench. 256k ctx, FR lab.
ollama run devstral-small2:24b
Sur Radeon RX 7900 XT
Q5_K_M
17 GB · 15 tok/s
3

EuroLLM 22B Instruct 2512

Utter Project · 22.6B paramètres · Apache 2.0 · 32 768 tokens ctx

Version 22B d'EuroLLM (Févr 2026). 35 langues UE. 32k ctx. Supplante EuroLLM 9B pour tâches lourdes.

Pourquoi ce rang Version 22B d'EuroLLM (Févr 2026). 35 langues UE. 32k ctx. Supplante EuroLLM 9B pour tâches lourdes.
# HuggingFace : utter-project/EuroLLM-22B-Instruct-2512
Sur Radeon RX 7900 XT
Q5_K_M
16 GB · 16 tok/s
4

🇨🇳 Qwen 3.6 27B

Alibaba · 27B paramètres · Apache 2.0 · 262 144 tokens ctx

Dense 27B multimodal sortie 22 avril 2026. 262k ctx (1M YaRN). SWE-bench Verified 77.2%.

Pourquoi ce rang Dense 27B multimodal sortie 22 avril 2026. 262k ctx (1M YaRN). SWE-bench Verified 77.2%.
ollama run qwen3.6:27b
Sur Radeon RX 7900 XT
Q5_K_M
19 GB · 13 tok/s
5

🇨🇳 Qwen 3.8 27B

Alibaba · 27B paramètres · Apache 2.0 · 262 144 tokens ctx

Qwen 3.8 27B : dense multimodal (texte + vision), 262k contexte, ~16 Go VRAM Q4 (18 Go de poids Ollama). Apache 2.0, code agentique et vision.

Pourquoi ce rang Qwen 3.8 27B : dense multimodal (texte + vision), 262k contexte, ~16 Go VRAM Q4 (18 Go de poids Ollama). Apache 2.0, code agentique et vision.
ollama run qwen3.8:27b
Sur Radeon RX 7900 XT
Q5_K_M
19 GB · 14 tok/s
6

🇫🇷 Mistral Small 3.1 24B

Mistral AI · 24B paramètres · Apache 2.0 · 128 000 tokens ctx

Small 3 enrichi de la vision. 128k ctx, Apache 2.0. Remplacé par Small 3.2 depuis juin 2025.

Pourquoi ce rang Small 3 enrichi de la vision. 128k ctx, Apache 2.0. Remplacé par Small 3.2 depuis juin 2025.
ollama run mistral-small3.1:24b
Sur Radeon RX 7900 XT
Q5_K_M
17 GB · 15 tok/s
7

🇫🇷 Magistral Small 24B

Mistral AI · 24B paramètres · Apache 2.0 · 128 000 tokens ctx

Premier raisonneur open Mistral. AIME24 70.7%. Base Small 3.1 + entraînement CoT.

Pourquoi ce rang Premier raisonneur open Mistral. AIME24 70.7%. Base Small 3.1 + entraînement CoT.
ollama run magistral:24b
Sur Radeon RX 7900 XT
Q5_K_M
17 GB · 15 tok/s

Tableau comparatif

Rang Modèle Params VRAM Q4 Contexte Licence Sur Radeon RX 7900 XT
#1 LLaDA 2.0 Uni 16B 16B 18 GB 8 192 Apache 2.0 60 tok/s · Q4_K_M
#2 Devstral Small 2 24B 24B 14 GB 256 000 Apache 2.0 15 tok/s · Q5_K_M
#3 EuroLLM 22B Instruct 2512 22.6B 13 GB 32 768 Apache 2.0 16 tok/s · Q5_K_M
#4 Qwen 3.6 27B 27B 16 GB 262 144 Apache 2.0 13 tok/s · Q5_K_M
#5 Qwen 3.8 27B 27B 16 GB 262 144 Apache 2.0 14 tok/s · Q5_K_M
#6 Mistral Small 3.1 24B 24B 14 GB 128 000 Apache 2.0 15 tok/s · Q5_K_M
#7 Magistral Small 24B 24B 14 GB 128 000 Apache 2.0 15 tok/s · Q5_K_M

Où acheter ce GPU ?

Comparez les prix de Radeon RX 7900 XT chez nos marchands partenaires (prix et stock à jour) :

Liens affiliés — QuelLLM peut percevoir une commission sur les achats, sans surcoût pour vous, ce qui n'influence pas le classement (établi de façon indépendante). En tant que Partenaire Amazon, QuelLLM réalise un bénéfice sur les achats remplissant les conditions requises.

Mémo gratuit

Quel modèle de code faire tourner sur TA machine ?

Reçois le mémo VRAM → meilleur modèle de code → commande Ollama (un seul écran, copier-coller). Et passe au kit Copilote Local pour en faire un setup qui marche vraiment.

Le kit Copilote Local — les configs Ollama + Cline + Aider prêtes à coller, Modelfiles réglés, dépannage, espace en ligne à vie →

Pas de spam. Désinscription en 1 clic. Tes données restent chez nous (jamais revendues).

Méthodologie du classement

Filtre : Q4_K_M ≤ 18 Go. Bonus 13-32B (peak 20 Go). 800 Go/s + ROCm 6.

Critères pris en compte :

  • Q4_K_M ≤ 18 Go
  • ROCm 6 compatible
  • Mistral Small 24B Q5
  • 20 Go inhabituels

Le scoring est entièrement transparent : consultez notre méthodologie pour les détails de calcul VRAM/tokens/sec.

Questions fréquentes

RX 7900 XT vs 7900 XTX ?

XT = 20 Go + 800 Go/s. XTX = 24 Go + 960 Go/s. Pour 24-32B Q4, les deux conviennent. XTX préférable pour fine-tuning ou 32B Q5. Voir RX 7900 XTX.

Pourquoi 20 Go et pas 16 ou 24 ?

Choix marketing AMD pour positionner entre 7900 XTX et le tier précédent. Pour LLM, c'est sweet spot : Mistral Small 24B Q4 (~13 Go) + contexte 32k + cache = ~18 Go.

ROCm sur 7900 XT : easy ?

Oui depuis ROCm 6 (2024). Ollama supporte natif via -gpu rocm. llama.cpp aussi. Plus simple qu'il y a 2 ans. Voir guide.

Sweet spot LLM 7900 XT ?

Mistral Small 24B Q5 (~17 Go) à 25 tok/s, Qwen 3 32B Q4 (~17 Go) à 22 tok/s. Excellent pour code + chat.

Pour aller plus loin