Intermédiaire 10 minRTX 20

Quel LLM sur RTX 2080 Ti (11 Go) ?

La RTX 2080 Ti (septembre 2018) reste une carte pertinente pour LLM en 2026 grâce à ses 11 Go de VRAM GDDR6 — quantité rare dans cette gamme de prix. 4 352 cœurs CUDA Turing, 616 Go/s de bande passante, TDP 250 W. À ~300-400 € d'occasion, elle offre l'accès à Phi-4 14B Q4 et Qwen 14B Q4 — impossible sur 8 Go plus récents. Ce guide détaille ses capacités LLM réelles en 2026.

Par Mohamed Meguedmi·Màj 2026-04-18·Testé sur Windows, macOS, Linux

#RTX 2080 Ti en 2026

Architecture
Turing TU102. TSMC 12nm (ancienne génération).
VRAM
11 Go GDDR6 14 Gbps, bus 352 bits. Bande passante 616 Go/s.
Cœurs CUDA
4 352. Tensor Cores 2ᵉ gen (FP16 uniquement).
TDP
250 W. Alim 650 W mini.
Prix 2026
300-400 € en occasion selon état.
Les 11 Go VRAM : un atout rare
Dans la gamme 300-400 € occasion, les 11 Go de la 2080 Ti sont uniques. Une 3070 à 300 € a 8 Go, une 3060 12 Go à 250 € a 12 Go mais est 30 % plus lente. La 2080 Ti trouve un créneau : plus rapide que la 3060 et plus de VRAM que la 3070.

#1. Modèles compatibles 11 Go

RTX 2080 Ti 11 Go — modèles LLM
ModèleQuantVRAMTokens/sec
Mistral 7BQ5_K_M5,1 Go55-62
Llama 3.1 8BQ5_K_M5,7 Go50-58
Qwen 2.5 Coder 7BQ6_K6,3 Go44-50
Phi-4 14BQ4_K_M8,5 Go30-36
Qwen 2.5 14BQ5_K_M10,5 Go22-28 (serré)

#2. Installation

  1. 01
    Drivers NVIDIA 525+
    Turing toujours supporté.
  2. 02
    Ollama
    Installation standard. Auto-détection GPU.

#3. Benchmarks

RTX 2080 Ti — tokens/sec Q4_K_M
ModèleTokens/sec
Mistral 7B60 t/s
Llama 3.1 8B54 t/s
Phi-4 14B32 t/s
Qwen 2.5 14B28 t/s

#4. vs 3060 12 Go, 4060 Ti 16 Go

Alternatives dans la même gamme de prix
CarteVRAMBande p.Mistral 7BPrix 2026
RTX 2080 Ti11 Go616 Go/s60 t/s~350 € occ.
RTX 3060 12 Go12 Go360 Go/s42 t/s~250 € occ.
RTX 4060 Ti 16 Go16 Go288 Go/s48 t/s~420 € occ.
RTX 30708 Go448 Go/s50 t/s~300 € occ.

#Verdict 2026

Gardez-la si vous l'avez
Toujours pertinente pour LLM 14B Q4. 11 Go est un sweet spot.
Achat occasion si ≤ 300 €
Rapport perf/€ intéressant face à 3060 12 Go. Au-delà, 4060 Ti 16 Go plus polyvalente.
Attention pilotes/support
Turing est progressivement déprécié. Certaines features LLM récentes (NVFP4, FA3) indisponibles.

#Questions fréquentes

La RTX 2080 Ti est-elle encore pertinente pour LLM en 2026 ?+
Oui, étonnamment. Les 11 Go VRAM ouvrent Phi-4 14B Q4 et Qwen 14B Q5, rare dans sa gamme de prix. Vitesse 60 tok/s sur Mistral 7B — correcte. Seul bémol : pilotes Turing progressivement en retrait.
RTX 2080 Ti ou RTX 3060 12 Go pour LLM ?+
Dépend du budget. 2080 Ti (~350 €) : plus rapide, 11 Go. 3060 12 Go (~250 €) : plus lente, 12 Go, moins gourmande. Pour pur perf/€, 3060 12 Go. Pour perf+VRAM, 2080 Ti.
Combien de tokens/sec pour Mistral 7B sur RTX 2080 Ti ?+
55-65 tokens/seconde en Q4_K_M. Équivalent à une RTX 4060 Ti 16 Go et supérieur à une 3060 12 Go.
La RTX 2080 Ti supporte-t-elle Flash Attention ?+
Partiellement. FA2 fonctionne mais avec moins d'optimisations qu'Ampere. FA3 et NVFP4 : non. Pour du LLM grand public avec llama.cpp/Ollama, suffisant.
Quelle alim pour RTX 2080 Ti ?+
650 W minimum qualité. TDP 250 W + CPU 120 W + système = 410 W. Pics Turing réputés gourmands (jusqu'à 320 W GPU seul).
Peut-on faire du fine-tuning sur RTX 2080 Ti ?+
QLoRA 7B-8B : oui confortable. QLoRA 14B : tangent, batch 1, contexte court. Pour un FT sérieux, visez 16 Go+.
La RTX 2080 Ti risque-t-elle de ne plus être supportée bientôt ?+
Driver gaming : pilotes NVIDIA Studio/Game Ready maintenus jusqu'en 2026-2027 probablement. CUDA : supporté jusqu'à CUDA 12.x. Pour LLM, 3-4 ans de vie restante au minimum.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.