Intermédiaire 10 minRTX 20
Quel LLM sur RTX 2080 Ti (11 Go) ?
La RTX 2080 Ti (septembre 2018) reste une carte pertinente pour LLM en 2026 grâce à ses 11 Go de VRAM GDDR6 — quantité rare dans cette gamme de prix. 4 352 cœurs CUDA Turing, 616 Go/s de bande passante, TDP 250 W. À ~300-400 € d'occasion, elle offre l'accès à Phi-4 14B Q4 et Qwen 14B Q4 — impossible sur 8 Go plus récents. Ce guide détaille ses capacités LLM réelles en 2026.
#RTX 2080 Ti en 2026
- Architecture
- Turing TU102. TSMC 12nm (ancienne génération).
- VRAM
- 11 Go GDDR6 14 Gbps, bus 352 bits. Bande passante 616 Go/s.
- Cœurs CUDA
- 4 352. Tensor Cores 2ᵉ gen (FP16 uniquement).
- TDP
- 250 W. Alim 650 W mini.
- Prix 2026
- 300-400 € en occasion selon état.
→
Les 11 Go VRAM : un atout rare
Dans la gamme 300-400 € occasion, les 11 Go de la 2080 Ti sont uniques. Une 3070 à 300 € a 8 Go, une 3060 12 Go à 250 € a 12 Go mais est 30 % plus lente. La 2080 Ti trouve un créneau : plus rapide que la 3060 et plus de VRAM que la 3070.
#1. Modèles compatibles 11 Go
RTX 2080 Ti 11 Go — modèles LLM
| Modèle | Quant | VRAM | Tokens/sec |
|---|---|---|---|
| Mistral 7B | Q5_K_M | 5,1 Go | 55-62 |
| Llama 3.1 8B | Q5_K_M | 5,7 Go | 50-58 |
| Qwen 2.5 Coder 7B | Q6_K | 6,3 Go | 44-50 |
| Phi-4 14B | Q4_K_M | 8,5 Go | 30-36 |
| Qwen 2.5 14B | Q5_K_M | 10,5 Go | 22-28 (serré) |
#2. Installation
- 01Drivers NVIDIA 525+Turing toujours supporté.
- 02OllamaInstallation standard. Auto-détection GPU.
#3. Benchmarks
RTX 2080 Ti — tokens/sec Q4_K_M
| Modèle | Tokens/sec |
|---|---|
| Mistral 7B | 60 t/s |
| Llama 3.1 8B | 54 t/s |
| Phi-4 14B | 32 t/s |
| Qwen 2.5 14B | 28 t/s |
#4. vs 3060 12 Go, 4060 Ti 16 Go
Alternatives dans la même gamme de prix
| Carte | VRAM | Bande p. | Mistral 7B | Prix 2026 |
|---|---|---|---|---|
| RTX 2080 Ti | 11 Go | 616 Go/s | 60 t/s | ~350 € occ. |
| RTX 3060 12 Go | 12 Go | 360 Go/s | 42 t/s | ~250 € occ. |
| RTX 4060 Ti 16 Go | 16 Go | 288 Go/s | 48 t/s | ~420 € occ. |
| RTX 3070 | 8 Go | 448 Go/s | 50 t/s | ~300 € occ. |
#Verdict 2026
- Gardez-la si vous l'avez
- Toujours pertinente pour LLM 14B Q4. 11 Go est un sweet spot.
- Achat occasion si ≤ 300 €
- Rapport perf/€ intéressant face à 3060 12 Go. Au-delà, 4060 Ti 16 Go plus polyvalente.
- Attention pilotes/support
- Turing est progressivement déprécié. Certaines features LLM récentes (NVFP4, FA3) indisponibles.
#Questions fréquentes
La RTX 2080 Ti est-elle encore pertinente pour LLM en 2026 ?+
Oui, étonnamment. Les 11 Go VRAM ouvrent Phi-4 14B Q4 et Qwen 14B Q5, rare dans sa gamme de prix. Vitesse 60 tok/s sur Mistral 7B — correcte. Seul bémol : pilotes Turing progressivement en retrait.
RTX 2080 Ti ou RTX 3060 12 Go pour LLM ?+
Dépend du budget. 2080 Ti (~350 €) : plus rapide, 11 Go. 3060 12 Go (~250 €) : plus lente, 12 Go, moins gourmande. Pour pur perf/€, 3060 12 Go. Pour perf+VRAM, 2080 Ti.
Combien de tokens/sec pour Mistral 7B sur RTX 2080 Ti ?+
55-65 tokens/seconde en Q4_K_M. Équivalent à une RTX 4060 Ti 16 Go et supérieur à une 3060 12 Go.
La RTX 2080 Ti supporte-t-elle Flash Attention ?+
Partiellement. FA2 fonctionne mais avec moins d'optimisations qu'Ampere. FA3 et NVFP4 : non. Pour du LLM grand public avec llama.cpp/Ollama, suffisant.
Quelle alim pour RTX 2080 Ti ?+
650 W minimum qualité. TDP 250 W + CPU 120 W + système = 410 W. Pics Turing réputés gourmands (jusqu'à 320 W GPU seul).
Peut-on faire du fine-tuning sur RTX 2080 Ti ?+
QLoRA 7B-8B : oui confortable. QLoRA 14B : tangent, batch 1, contexte court. Pour un FT sérieux, visez 16 Go+.
La RTX 2080 Ti risque-t-elle de ne plus être supportée bientôt ?+
Driver gaming : pilotes NVIDIA Studio/Game Ready maintenus jusqu'en 2026-2027 probablement. CUDA : supporté jusqu'à CUDA 12.x. Pour LLM, 3-4 ans de vie restante au minimum.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.