Débutant 9 minGTX 16
Quel LLM sur GTX 1650 / 1660 / Super / Ti ?
La gamme GTX 16 (avril 2019) — 1650, 1660, 1660 Super, 1660 Ti — est Turing sans RT ni Tensor Cores. 4 à 6 Go de VRAM selon modèle, TDP 75-125 W. En 2026, à 80-160 € d'occasion, ce sont les cartes les moins gourmandes encore capables de LLM léger. Mais VRAM limitée (4-6 Go) et l'absence de Tensor Cores les cantonne aux petits modèles de 2 à 8B selon la carte. Ce guide détaille chaque variante.
#La gamme GTX 16
- Turing sans RT
- Même architecture que RTX 20 mais sans RT Cores ni Tensor Cores.
- Gamme
- GTX 1650 (4 Go), 1660 (6 Go), 1660 Super (6 Go), 1660 Ti (6 Go).
- TDP
- 75 W (1650) à 125 W (1660 Ti).
#1. Les 4 variantes
Comparatif GTX 16
| Carte | VRAM | Bande p. | Granite 4.2 8B Q4 | Prix 2026 |
|---|---|---|---|---|
| GTX 1650 | 4 Go | 128 Go/s | ❌ débordement | ~80 € occ. |
| GTX 1660 | 6 Go | 192 Go/s | 10 t/s tangent | ~100 € occ. |
| GTX 1660 Super | 6 Go | 336 Go/s | 14 t/s | ~130 € occ. |
| GTX 1660 Ti | 6 Go | 288 Go/s | 16 t/s | ~150 € occ. |
#2. Modèles utilisables
GTX 1660 Super — modèles LLM
| Modèle | Quant | VRAM | Tokens/sec |
|---|---|---|---|
| Qwen 3.5 2B | Q8_0 | 1,9 Go | 48-58 t/s |
| Granite 4.2 3B | Q5_K_M | 2,2 Go | 28-34 t/s |
| Qwen 3.5 4B | Q8_0 | 3,4 Go | 22-26 t/s |
| Granite 4.2 8B | Q4_K_M | 5,3 Go | 13-16 t/s (tangent) |
!
GTX 1650 4 Go : inadaptée LLM
Granite 4.2 8B Q4 (5,3 Go) + contexte = déborde largement les 4 Go. Limitée à Qwen 3.5 4B (3,4 Go) ou plus petit. Pour LLM, à éviter (sauf usage Qwen 3.5 2B en draft).
#Verdict 2026
- GTX 1660 Super
- Meilleur choix de la gamme pour LLM entrée de gamme. Granite 4.2 8B Q4 à 14 tok/s — utilisable.
- GTX 1650
- À éviter pour LLM. 4 Go insuffisants.
- Préférez RTX 3050 8 Go neuve
- Pour ~180 € vs ~150 € (1660 Ti), +33 % VRAM, Tensor Cores, support long terme.
#Questions fréquentes
Peut-on faire tourner un LLM sur GTX 1660 ?+
Oui, Granite 4.2 8B Q4 (128k ctx, très sobre en tokens) à 10-16 tok/s selon variante (1660, Super ou Ti). Suffisant pour découvrir le LLM local.
Quelle GTX 16 pour LLM ?+
GTX 1660 Super — meilleur rapport bande passante / prix. La 1660 Ti est légèrement plus rapide mais 20 € plus chère en occasion.
La GTX 1650 4 Go peut-elle faire tourner un modèle 8B ?+
Non confortablement. Granite 4.2 8B Q4 (5,3 Go) déborde avec contexte. Restez sur Qwen 3.5 4B (3,4 Go) ou Granite 4.2 3B (2,2 Go) ou plus petit.
GTX 1660 Super ou RTX 3050 pour LLM ?+
RTX 3050 si budget neuf 180 € : Tensor Cores, 8 Go VRAM (vs 6), support 2028+. GTX 1660 Super occasion 130 € : correct pour budget serré, 3-5 ans d'usage restant.
Les GTX 16 supportent-elles Flash Attention ?+
Non — pas de Tensor Cores. llama.cpp utilise le fallback CUDA standard. Performances correctes mais pas optimales.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.