Débutant 10 minRTX 30
Quel LLM sur RTX 3070 / 3070 Ti (8 Go) ?
Les RTX 3070 (octobre 2020) et 3070 Ti (juin 2021) ont 8 Go de VRAM GDDR6/GDDR6X et 5 888 / 6 144 cœurs CUDA Ampere. En 2026, elles se trouvent à 300-400 € d'occasion. Pour le LLM, elles tiennent confortablement Mistral 7B Q5 et Llama 3.1 8B Q4, mais coincent dès qu'on vise les 14B. Ce guide détaille leurs capacités réelles et leurs alternatives.
#RTX 3070 et 3070 Ti
- RTX 3070
- GA104, 5 888 CUs, 448 Go/s (GDDR6), TDP 220 W. ~300 € occasion.
- RTX 3070 Ti
- GA104, 6 144 CUs, 608 Go/s (GDDR6X, +36 %), TDP 290 W. ~380 € occasion.
#1. Modèles compatibles 8 Go
RTX 3070 / 3070 Ti — 8 Go VRAM
| Modèle | Quant | VRAM | 3070 | 3070 Ti |
|---|---|---|---|---|
| Llama 3.2 3B | Q8_0 | 3,4 Go | 68 t/s | 78 t/s |
| Mistral 7B | Q4_K_M | 4,4 Go | 50 t/s | 58 t/s |
| Mistral 7B | Q5_K_M | 5,1 Go | 44 t/s | 52 t/s |
| Llama 3.1 8B | Q4_K_M | 4,9 Go | 44 t/s | 52 t/s |
| Qwen 2.5 Coder 7B | Q4_K_M | 4,5 Go | 46 t/s | 54 t/s |
#2. Installation
#3. Benchmarks
RTX 3070 Ti > RTX 3070 de ~15 % grâce à la GDDR6X. Sur 7B Q4, 58 vs 50 tokens/seconde.
#4. Limite des 8 Go
- Phi-4 14B Q4
- 8,5 Go → débordement. 14B hors de portée confortable.
- Contexte > 8k
- Avec Mistral 7B Q4 (5 Go), contexte 32k = +3 Go KV cache → déborde. Activez OLLAMA_KV_CACHE_TYPE=q8_0.
- Pas de RAG multi-stage
- Mistral 7B + embedder = 6 Go. Ajouter un reranker déborde.
#5. 3070 vs 4060 Ti 16 Go
8 Go Ampere vs 16 Go Ada
| Carte | VRAM | Bande p. | Mistral 7B | Prix 2026 |
|---|---|---|---|---|
| RTX 3070 | 8 Go | 448 Go/s | 50 t/s | ~300 € occ. |
| RTX 3070 Ti | 8 Go | 608 Go/s | 58 t/s | ~380 € occ. |
| RTX 4060 Ti 16 Go | 16 Go | 288 Go/s | 48 t/s | ~420 € occ. |
| RTX 3060 12 Go | 12 Go | 360 Go/s | 40 t/s | ~250 € occ. |
→
Pour 40 € de plus, la 4060 Ti 16 Go domine en LLM
Même vitesse 7B, mais DOUBLE de VRAM. Accès aux 14B et 24B impossibles sur 3070. La 3070 ne fait sens que si vous l'avez déjà ou à prix ≤ 280 € occasion.
#Verdict 2026
- Gardez votre 3070 si
- Elle fonctionne. Usage 7B-8B confortable. Ne vendez que si vraiment besoin d'upgrade.
- N'achetez pas une 3070 en 2026
- Sauf à < 280 € avec bonne garantie. Préférez 3060 12 Go à 250 € (plus de VRAM) ou 4060 Ti 16 Go à 420 €.
#Questions fréquentes
La RTX 3070 peut-elle faire tourner Mistral 7B ?+
Oui très bien en Q4_K_M : 50 tok/s sur 3070, 58 tok/s sur Ti. Q5 jouable (5,1 Go) mais serré. Restez sur Q4 pour marge contexte.
RTX 3070 ou RTX 3060 12 Go pour LLM ?+
Dépend priorité. 3070 : plus rapide (+25 %), 8 Go. 3060 12 Go : plus de VRAM (+50 %), moins rapide. Pour LLM, 3060 12 Go gagne — capacité > vitesse.
Quelle est la vraie différence entre 3070 et 3070 Ti ?+
+5 % de CUs, +36 % de bande passante (GDDR6X). Sur LLM : +15 % de tokens/sec en faveur de la Ti. Pour 80 € d'écart occasion, la Ti vaut le coup.
Peut-on tourner Phi-4 14B sur RTX 3070 ?+
Non confortablement. Q4 (8,5 Go) déborde légèrement. Q3_K_S (6,5 Go) passe mais qualité dégradée. Évitez — préférez Mistral 7B Q5 ou Llama 3.1 8B Q5.
Peut-on faire du QLoRA sur RTX 3070 ?+
Sur 3B-4B : oui. Sur 7B-8B : tight, batch 1, contexte 2048 max. Pour FT sérieux, 12 Go+ recommandés.
Alim 550 W suffit pour RTX 3070 Ti ?+
Pour la Ti (290 W TDP) : ça tient avec CPU moyen. La 3070 classique (220 W) n'a aucun problème sur 500 W.
La RTX 3070 vaut-elle la peine en 2026 ?+
En neuf : non, introuvable en stock. En occasion à ≤ 300 € : acceptable. Préférez 3060 12 Go (plus VRAM) ou 5060 neuve (plus rapide) dans la même gamme de prix.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.