Débutant 10 minRTX 30

Quel LLM sur RTX 3070 / 3070 Ti (8 Go) ?

Les RTX 3070 (octobre 2020) et 3070 Ti (juin 2021) ont 8 Go de VRAM GDDR6/GDDR6X et 5 888 / 6 144 cœurs CUDA Ampere. En 2026, elles se trouvent à 300-400 € d'occasion. Pour le LLM, elles tiennent confortablement Mistral 7B Q5 et Llama 3.1 8B Q4, mais coincent dès qu'on vise les 14B. Ce guide détaille leurs capacités réelles et leurs alternatives.

Par Mohamed Meguedmi·Màj 2026-04-18·Testé sur Windows, macOS, Linux

#RTX 3070 et 3070 Ti

RTX 3070
GA104, 5 888 CUs, 448 Go/s (GDDR6), TDP 220 W. ~300 € occasion.
RTX 3070 Ti
GA104, 6 144 CUs, 608 Go/s (GDDR6X, +36 %), TDP 290 W. ~380 € occasion.

#1. Modèles compatibles 8 Go

RTX 3070 / 3070 Ti — 8 Go VRAM
ModèleQuantVRAM30703070 Ti
Llama 3.2 3BQ8_03,4 Go68 t/s78 t/s
Mistral 7BQ4_K_M4,4 Go50 t/s58 t/s
Mistral 7BQ5_K_M5,1 Go44 t/s52 t/s
Llama 3.1 8BQ4_K_M4,9 Go44 t/s52 t/s
Qwen 2.5 Coder 7BQ4_K_M4,5 Go46 t/s54 t/s

#2. Installation

Installation Ollama
winget install Ollama.Ollama
ollama run mistral   # 7B Q4 confortable

#3. Benchmarks

RTX 3070 Ti > RTX 3070 de ~15 % grâce à la GDDR6X. Sur 7B Q4, 58 vs 50 tokens/seconde.

#4. Limite des 8 Go

Phi-4 14B Q4
8,5 Go → débordement. 14B hors de portée confortable.
Contexte > 8k
Avec Mistral 7B Q4 (5 Go), contexte 32k = +3 Go KV cache → déborde. Activez OLLAMA_KV_CACHE_TYPE=q8_0.
Pas de RAG multi-stage
Mistral 7B + embedder = 6 Go. Ajouter un reranker déborde.

#5. 3070 vs 4060 Ti 16 Go

8 Go Ampere vs 16 Go Ada
CarteVRAMBande p.Mistral 7BPrix 2026
RTX 30708 Go448 Go/s50 t/s~300 € occ.
RTX 3070 Ti8 Go608 Go/s58 t/s~380 € occ.
RTX 4060 Ti 16 Go16 Go288 Go/s48 t/s~420 € occ.
RTX 3060 12 Go12 Go360 Go/s40 t/s~250 € occ.
Pour 40 € de plus, la 4060 Ti 16 Go domine en LLM
Même vitesse 7B, mais DOUBLE de VRAM. Accès aux 14B et 24B impossibles sur 3070. La 3070 ne fait sens que si vous l'avez déjà ou à prix ≤ 280 € occasion.

#Verdict 2026

Gardez votre 3070 si
Elle fonctionne. Usage 7B-8B confortable. Ne vendez que si vraiment besoin d'upgrade.
N'achetez pas une 3070 en 2026
Sauf à < 280 € avec bonne garantie. Préférez 3060 12 Go à 250 € (plus de VRAM) ou 4060 Ti 16 Go à 420 €.

#Questions fréquentes

La RTX 3070 peut-elle faire tourner Mistral 7B ?+
Oui très bien en Q4_K_M : 50 tok/s sur 3070, 58 tok/s sur Ti. Q5 jouable (5,1 Go) mais serré. Restez sur Q4 pour marge contexte.
RTX 3070 ou RTX 3060 12 Go pour LLM ?+
Dépend priorité. 3070 : plus rapide (+25 %), 8 Go. 3060 12 Go : plus de VRAM (+50 %), moins rapide. Pour LLM, 3060 12 Go gagne — capacité > vitesse.
Quelle est la vraie différence entre 3070 et 3070 Ti ?+
+5 % de CUs, +36 % de bande passante (GDDR6X). Sur LLM : +15 % de tokens/sec en faveur de la Ti. Pour 80 € d'écart occasion, la Ti vaut le coup.
Peut-on tourner Phi-4 14B sur RTX 3070 ?+
Non confortablement. Q4 (8,5 Go) déborde légèrement. Q3_K_S (6,5 Go) passe mais qualité dégradée. Évitez — préférez Mistral 7B Q5 ou Llama 3.1 8B Q5.
Peut-on faire du QLoRA sur RTX 3070 ?+
Sur 3B-4B : oui. Sur 7B-8B : tight, batch 1, contexte 2048 max. Pour FT sérieux, 12 Go+ recommandés.
Alim 550 W suffit pour RTX 3070 Ti ?+
Pour la Ti (290 W TDP) : ça tient avec CPU moyen. La 3070 classique (220 W) n'a aucun problème sur 500 W.
La RTX 3070 vaut-elle la peine en 2026 ?+
En neuf : non, introuvable en stock. En occasion à ≤ 300 € : acceptable. Préférez 3060 12 Go (plus VRAM) ou 5060 neuve (plus rapide) dans la même gamme de prix.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.