Intermédiaire 10 minRTX 20
Quel LLM sur RTX 2080 Ti (11 Go) ?
La RTX 2080 Ti (septembre 2018) reste une carte pertinente pour LLM en 2026 grâce à ses 11 Go de VRAM GDDR6 — quantité rare dans cette gamme de prix. 4 352 cœurs CUDA Turing, 616 Go/s de bande passante, TDP 250 W. À ~300-400 € d'occasion, elle offre l'accès à Gemma 4 12B Q4 et Qwen 3.5 9B en Q8 — impossible sur 8 Go plus récents. Ce guide détaille ses capacités LLM réelles en 2026.
#RTX 2080 Ti en 2026
- Architecture
- Turing TU102. TSMC 12nm (ancienne génération).
- VRAM
- 11 Go GDDR6 14 Gbps, bus 352 bits. Bande passante 616 Go/s.
- Cœurs CUDA
- 4 352. Tensor Cores 2ᵉ gen (FP16 uniquement).
- TDP
- 250 W. Alim 650 W mini.
- Prix 2026
- 300-400 € en occasion selon état.
→
Les 11 Go VRAM : un atout rare
Dans la gamme 300-400 € occasion, les 11 Go de la 2080 Ti sont uniques. Une 3070 à 300 € a 8 Go, une 3060 12 Go à 250 € a 12 Go mais est 30 % plus lente. La 2080 Ti trouve un créneau : plus rapide que la 3060 et plus de VRAM que la 3070.
#1. Modèles compatibles 11 Go
RTX 2080 Ti 11 Go — modèles LLM
| Modèle | Quant | VRAM | Tokens/sec |
|---|---|---|---|
| Gemma 4 12B | Q4_K_M | 7 Go | 16-20 |
| Granite 4.2 8B | Q5_K_M | 6 Go | 29-35 |
| Qwen 3.5 9B | Q4_K_M | 6 Go | 8-10 |
| Qwen 3.5 4B | FP16 | 8 Go | 29-35 |
#2. Installation
- 01Drivers NVIDIA 525+Turing toujours supporté.
- 02OllamaInstallation standard. Auto-détection GPU.
#3. Benchmarks
RTX 2080 Ti — tokens/sec Q4_K_M (ordres de grandeur)
| Modèle | Tokens/sec |
|---|---|
| Qwen 3.5 4B | 85 t/s |
| Granite 4.2 8B | 55 t/s |
| Qwen 3.5 9B | 48 t/s |
| Gemma 4 12B | 38 t/s |
#4. vs 3060 12 Go, 4060 Ti 16 Go
Alternatives dans la même gamme de prix
| Carte | VRAM | Bande p. | Granite 4.2 8B | Prix 2026 |
|---|---|---|---|---|
| RTX 2080 Ti | 11 Go | 616 Go/s | 55 t/s | ~350 € occ. |
| RTX 3060 12 Go | 12 Go | 360 Go/s | 38 t/s | ~250 € occ. |
| RTX 4060 Ti 16 Go | 16 Go | 288 Go/s | 44 t/s | ~420 € occ. |
| RTX 3070 | 8 Go | 448 Go/s | 46 t/s | ~300 € occ. |
#Verdict 2026
- Gardez-la si vous l'avez
- Toujours pertinente pour du 12B Q4 (Gemma 4 12B). 11 Go est un sweet spot.
- Achat occasion si ≤ 300 €
- Rapport perf/€ intéressant face à 3060 12 Go. Au-delà, 4060 Ti 16 Go plus polyvalente.
- Attention pilotes/support
- Turing est progressivement déprécié. Certaines features LLM récentes (NVFP4, FA3) indisponibles.
#Questions fréquentes
La RTX 2080 Ti est-elle encore pertinente pour LLM en 2026 ?+
Oui, étonnamment. Les 11 Go VRAM ouvrent Gemma 4 12B Q4 et Qwen 3.5 9B en Q8, rare dans sa gamme de prix. Vitesse ~55 tok/s sur Granite 4.2 8B — correcte. Seul bémol : pilotes Turing progressivement en retrait.
RTX 2080 Ti ou RTX 3060 12 Go pour LLM ?+
Dépend du budget. 2080 Ti (~350 €) : plus rapide, 11 Go. 3060 12 Go (~250 €) : plus lente, 12 Go, moins gourmande. Pour pur perf/€, 3060 12 Go. Pour perf+VRAM, 2080 Ti.
Combien de tokens/sec pour Granite 4.2 8B sur RTX 2080 Ti ?+
50-60 tokens/seconde en Q4_K_M. Équivalent à une RTX 4060 Ti 16 Go et supérieur à une 3060 12 Go.
La RTX 2080 Ti supporte-t-elle Flash Attention ?+
Partiellement. FA2 fonctionne mais avec moins d'optimisations qu'Ampere. FA3 et NVFP4 : non. Pour du LLM grand public avec llama.cpp/Ollama, suffisant.
Quelle alim pour RTX 2080 Ti ?+
650 W minimum qualité. TDP 250 W + CPU 120 W + système = 410 W. Pics Turing réputés gourmands (jusqu'à 320 W GPU seul).
Peut-on faire du fine-tuning sur RTX 2080 Ti ?+
QLoRA 7B-8B : oui confortable. QLoRA 14B : tangent, batch 1, contexte court. Pour un FT sérieux, visez 16 Go+.
La RTX 2080 Ti risque-t-elle de ne plus être supportée bientôt ?+
Driver gaming : pilotes NVIDIA Studio/Game Ready maintenus jusqu'en 2026-2027 probablement. CUDA : supporté jusqu'à CUDA 12.x. Pour LLM, 3-4 ans de vie restante au minimum.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.