Quel LLM sur GTX 1080 Ti (11 Go) ?
La GTX 1080 Ti (mars 2017) a 11 Go de VRAM GDDR5X — quantité exceptionnelle pour une carte de 2017. Pascal GP102, 3 584 cœurs CUDA, 484 Go/s de bande passante, TDP 250 W. En 2026 à 150-220 € d'occasion, elle intéresse les budgets très serrés. Mais attention : pas de Tensor Cores, pas de FP16 natif, pilotes Pascal de plus en plus en retrait. Ce guide détaille ce qu'elle peut encore faire et ses limites.
#La GTX 1080 Ti en 2026
- Architecture
- Pascal GP102 (2017). TSMC 16nm.
- VRAM
- 11 Go GDDR5X 11 Gbps, bus 352 bits. Bande passante 484 Go/s.
- Cœurs CUDA
- 3 584. Pas de Tensor Cores, pas de RT Cores.
- TDP
- 250 W. Alim 650 W mini.
- Prix 2026
- 150-220 € selon état en occasion.
#1. Limites Pascal pour LLM
- FP16 dégradé
- Sur Pascal, FP16 est 2× plus lent que sur Turing+. Flash Attention, FA2, FA3 : tous en mode basique.
- Pas de FP8
- Impossible d'exploiter les quantizations modernes NVFP4, FP8. Reste sur Q4-Q8 GGUF classiques.
- Drivers 2026
- NVIDIA a annoncé la fin du support Studio/Game Ready pour Pascal en 2026-2027. CUDA 12.x encore supporté.
- Consommation
- 250 W pour ~60 % de la perf LLM d'une RTX 3060 (170 W). Inefficient.
#2. Modèles utilisables
| Modèle | Quant | VRAM | Tokens/sec |
|---|---|---|---|
| Granite 4.2 8B | Q4_K_M | 4,6 Go | 29-35 t/s |
| Qwen 3.5 9B | Q4_K_M | 6 Go | 8-10 t/s |
| Gemma 4 12B | Q4_K_M | 7 Go | 16-20 t/s |
| Qwen 3.5 4B | FP16 | 8 Go | 29-35 t/s |
#3. Installation
- 01Drivers NVIDIA 535+Encore supportés en 2026 mais plus de new features.
- 02OllamaInstallation standard. Ollama reconnaît Pascal (CUDA).
- 03Pas de flash attention moderneexport GGML_CUDA_NO_FLASH_ATTN=1 si erreurs au chargement.
#4. Benchmarks
Granite 4.2 8B Q4_K_M : 29-35 tok/s, fluide. Qwen 3.5 9B Q4 : 8-10 tok/s — nettement plus lent sur Pascal (pas de Tensor Cores), mais utilisable. Gemma 4 12B Q4 : 16-20 tok/s, plus lourd mais les 11 Go l'accueillent avec du contexte confortable, chose bien plus tendue sur 8 Go.
#Verdict 2026
- Gardez-la si dans un PC existant
- Les 11 Go lui donnent un atout unique dans la gamme Pascal — Gemma 4 12B tourne avec du contexte, plus lentement mais il tourne.
- N'achetez pas en 2026
- Sauf à ≤ 120 € avec garantie. Au-dessus, une RTX 3060 12 Go (~250 €) fait 2× mieux sur tous les critères.
- Fin de vie annoncée
- Planifiez une transition dans 1-2 ans. Support progressivement en retrait.
#Questions fréquentes
La GTX 1080 Ti peut-elle encore faire tourner un LLM en 2026 ?+
Pourquoi la 1080 Ti est-elle plus lente qu'une 3060 pour LLM ?+
GTX 1080 Ti ou RTX 2060 Super pour LLM ?+
Combien consomme la GTX 1080 Ti en LLM ?+
La 1080 Ti supporte-t-elle CUDA 12 en 2026 ?+
Peut-on faire du QLoRA sur GTX 1080 Ti ?+
Quand la GTX 1080 Ti cessera-t-elle d'être supportée ?+
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.