Débutant 10 minRTX 30
Quel LLM sur RTX 3070 / 3070 Ti (8 Go) ?
Les RTX 3070 (octobre 2020) et 3070 Ti (juin 2021) ont 8 Go de VRAM GDDR6/GDDR6X et 5 888 / 6 144 cœurs CUDA Ampere. En 2026, elles se trouvent à 300-400 € d'occasion. Pour le LLM, elles tiennent confortablement Granite 4.2 8B Q4 et Qwen 3.5 9B Q4, mais coincent dès qu'on vise les 24B. Ce guide détaille leurs capacités réelles et leurs alternatives.
#RTX 3070 et 3070 Ti
- RTX 3070
- GA104, 5 888 CUs, 448 Go/s (GDDR6), TDP 220 W. ~300 € occasion.
- RTX 3070 Ti
- GA104, 6 144 CUs, 608 Go/s (GDDR6X, +36 %), TDP 290 W. ~380 € occasion.
#1. Modèles compatibles 8 Go
RTX 3070 / 3070 Ti — 8 Go VRAM
| Modèle | Quant | VRAM | 3070 | 3070 Ti |
|---|---|---|---|---|
| Granite 4.2 8B | Q4_K_M | 4,6 Go | 68 t/s | 78 t/s |
| Qwen 3.5 9B | Q4_K_M | 6 Go | 50 t/s | 58 t/s |
| Gemma 4 2B | FP16 | 4 Go | 44 t/s | 52 t/s |
| Qwen 3.5 4B | Q8_0 | 4,3 Go | 44 t/s | 52 t/s |
#2. Installation
#3. Benchmarks
RTX 3070 Ti > RTX 3070 de ~15 % grâce à la GDDR6X. Sur Qwen 3.5 9B Q4, 58 vs 50 tokens/seconde.
#4. Limite des 8 Go
- Modèles 24B (14 Go)
- gpt-oss 20B ou Mistral Small 24B en Q4 = 14 Go → largement hors de portée. La tranche 24B réclame 16 Go de VRAM.
- Contexte > 8k
- Avec Granite 4.2 8B Q4 (5,3 Go), contexte 32k = +3 Go KV cache → déborde. Activez OLLAMA_KV_CACHE_TYPE=q8_0.
- Pas de RAG multi-stage
- Granite 4.2 8B + embedder = 6,5 Go. Ajouter un reranker déborde.
#5. 3070 vs 4060 Ti 16 Go
8 Go Ampere vs 16 Go Ada
| Carte | VRAM | Bande p. | Qwen 3.5 9B | Prix 2026 |
|---|---|---|---|---|
| RTX 3070 | 8 Go | 448 Go/s | 50 t/s | ~300 € occ. |
| RTX 3070 Ti | 8 Go | 608 Go/s | 58 t/s | ~380 € occ. |
| RTX 4060 Ti 16 Go | 16 Go | 288 Go/s | 48 t/s | ~420 € occ. |
| RTX 3060 12 Go | 12 Go | 360 Go/s | 40 t/s | ~250 € occ. |
→
Pour 40 € de plus, la 4060 Ti 16 Go domine en LLM
Même vitesse sur un 8B, mais DOUBLE de VRAM. Accès aux 24B (Devstral, Mistral Small) impossible sur 3070. La 3070 ne fait sens que si vous l'avez déjà ou à prix ≤ 280 € occasion.
#Verdict 2026
- Gardez votre 3070 si
- Elle fonctionne. Usage 8B confortable (Granite 4.2 8B, Qwen 3.5 9B). Ne vendez que si vraiment besoin d'upgrade.
- N'achetez pas une 3070 en 2026
- Sauf à < 280 € avec bonne garantie. Préférez 3060 12 Go à 250 € (plus de VRAM) ou 4060 Ti 16 Go à 420 €.
#Questions fréquentes
La RTX 3070 peut-elle faire tourner un bon modèle 8B en 2026 ?+
Oui très bien : Qwen 3.5 9B Q4 (6 Go) tourne à 50 tok/s sur 3070, 58 tok/s sur Ti ; Granite 4.2 8B Q4 (5,3 Go) est encore plus rapide. Restez sur Q4 pour garder de la marge de contexte.
RTX 3070 ou RTX 3060 12 Go pour LLM ?+
Dépend priorité. 3070 : plus rapide (+25 %), 8 Go. 3060 12 Go : plus de VRAM (+50 %), moins rapide. Pour LLM, 3060 12 Go gagne — capacité > vitesse.
Quelle est la vraie différence entre 3070 et 3070 Ti ?+
+5 % de CUs, +36 % de bande passante (GDDR6X). Sur LLM : +15 % de tokens/sec en faveur de la Ti. Pour 80 € d'écart occasion, la Ti vaut le coup.
Peut-on tourner un modèle 24B (Devstral, Mistral Small) sur RTX 3070 ?+
Non : ces modèles en Q4 pèsent ~14 Go et débordent largement les 8 Go. Il faut 16 Go de VRAM pour la tranche 24B. Sur 3070, restez sur Qwen 3.5 9B Q4 ou Granite 4.2 8B Q4.
Peut-on faire du QLoRA sur RTX 3070 ?+
Sur 3B-4B : oui. Sur 7B-8B : tight, batch 1, contexte 2048 max. Pour FT sérieux, 12 Go+ recommandés.
Alim 550 W suffit pour RTX 3070 Ti ?+
Pour la Ti (290 W TDP) : ça tient avec CPU moyen. La 3070 classique (220 W) n'a aucun problème sur 500 W.
La RTX 3070 vaut-elle la peine en 2026 ?+
En neuf : non, introuvable en stock. En occasion à ≤ 300 € : acceptable. Préférez 3060 12 Go (plus VRAM) ou 5060 neuve (plus rapide) dans la même gamme de prix.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.