Débutant 9 minRTX 20

Quel LLM sur RTX 2070 / 2070 Super (8 Go) ?

Les RTX 2070 (octobre 2018) et 2070 Super (juillet 2019) ont 8 Go de VRAM GDDR6, 2 304 / 2 560 cœurs CUDA, bande passante 448 Go/s. En 2026 à ~180-220 € occasion, ce sont des entrées de gamme LLM acceptables pour Mistral 7B mais sans plus. Ce guide détaille leurs capacités réelles.

Par Mohamed Meguedmi·Màj 2026-04-18·Testé sur Windows, macOS, Linux

#RTX 2070 / 2070 Super

RTX 2070
Turing TU106, 2 304 CUs, 448 Go/s, TDP 175 W. ~180 € occ.
RTX 2070 Super
TU104 cut-down, 2 560 CUs, 448 Go/s, TDP 215 W. ~220 € occ.
VRAM commune
8 Go GDDR6.

#1. Modèles compatibles

RTX 2070 Super — modèles
ModèleQuantVRAMTokens/sec
Qwen 2.5 3BQ5_K_M2,2 Go52 t/s
Llama 3.2 3BQ8_03,4 Go46 t/s
Mistral 7BQ4_K_M4,4 Go36 t/s
Llama 3.1 8BQ4_K_M4,9 Go32 t/s

#2. Benchmarks

RTX 2070 Super : Mistral 7B Q4 = 36 tok/s. RTX 2070 : ~32 tok/s. Modestes mais utilisables pour du chat.

#Verdict 2026

Gardez si vous l'avez
Correcte pour Mistral 7B chat. Pas d'upgrade prioritaire.
N'achetez pas
La RTX 3060 12 Go (~250 €) offre bien mieux pour 30-50 € de plus.

#Questions fréquentes

La RTX 2070 peut-elle faire tourner un LLM ?+
Oui, Mistral 7B Q4 à 32 tok/s, Llama 3.1 8B Q4 à 28 tok/s. Correct pour chat, lent pour batch.
RTX 2070 ou RTX 2070 Super ?+
Super ~12 % plus rapide pour ~40 € de plus. Rapport perf/€ équivalent.
Peut-on tourner Phi-4 14B sur RTX 2070 ?+
Non, 8 Go insuffisants pour Q4 (8,5 Go). Restez sur Mistral 7B ou Llama 3.1 8B.
Combien de tokens/sec Mistral 7B RTX 2070 Super ?+
34-38 tokens/seconde en Q4_K_M. 15 % plus lent qu'une RTX 3060 12 Go.
La RTX 2070 est-elle toujours supportée par les drivers 2026 ?+
Oui, Turing toujours maintenu. CUDA 12.x supporté. Pour LLM Ollama/llama.cpp, aucun problème.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.