Intermédiaire 12 minRTX 30
Quel LLM sur RTX 3090 / 3090 Ti (24 Go) ?
La RTX 3090 (septembre 2020) et la 3090 Ti (mars 2022) sont devenues en 2026 les meilleures affaires LLM grand public. 24 Go de VRAM GDDR6X, 936 à 1008 Go/s de bande passante, 10 496 / 10 752 cœurs CUDA Ampere. Désormais à 700-850 € en occasion (3090) et 900-1000 € (3090 Ti), elles font tourner Qwen 32B Q4, DeepSeek-Coder 33B et même Llama 70B en offload léger. Ce guide détaille pourquoi c'est encore un choix très pertinent en 2026.
#RTX 3090 et 3090 Ti en 2026
- Architecture
- Ampere GA102. TSMC Samsung 8nm (moins efficient qu'Ada).
- VRAM
- 24 Go GDDR6X 19,5 Gbps (3090) / 21 Gbps (Ti). Bande passante 936 / 1008 Go/s.
- Cœurs CUDA
- 10 496 (3090) / 10 752 (Ti).
- TDP
- 350 W (3090) / 450 W (Ti). Alim 850 W mini.
- Prix 2026
- 3090 : 700-850 €. 3090 Ti : 900-1000 €. Prix en baisse lente.
→
Le meilleur rapport 24 Go/€ du marché en 2026
Pour 700-850 €, c'est 3× moins cher qu'une RTX 5090 et 2× moins qu'une 4090 occasion, avec les mêmes 24 Go de VRAM. Vous perdez 30-40 % en vitesse brute vs 4090 mais gagnez la capacité — le critère qui compte pour le LLM.
#1. Modèles compatibles 24 Go
Modèles LLM — RTX 3090 / 3090 Ti 24 Go
| Modèle | Quant | VRAM | Tokens/sec (3090) | Usage |
|---|---|---|---|---|
| Mistral 7B | Q5_K_M | 5,1 Go | 72-82 | Chat rapide |
| Llama 3.1 8B | Q6_K | 6,7 Go | 64-74 | Chat + RAG FR |
| Qwen 2.5 Coder 14B | Q6_K | 11,7 Go | 40-48 | Code pro |
| Phi-4 14B | Q8_0 | 15 Go | 34-40 | Reasoning qualité |
| Mistral Small 24B | Q6_K | 20 Go | 22-28 | Polyvalent |
| Qwen 2.5 32B | Q5_K_M | 23 Go | 18-22 | Reasoning avancé |
| DeepSeek-Coder 33B | Q4_K_M | 19 Go | 20-26 | Code multi-fichiers |
| Llama 3.3 70B | Q2_K | 26 Go | 5-8 | Offload léger, usable |
| Llama 3.3 70B | IQ2_XS | 21 Go | 12-16 | VRAM only |
#2. Installation
- 01Drivers NVIDIA 535+Standard Ampere.
- 02OllamaInstallation depuis ollama.com. Auto-détection GPU.
- 03Premier modèle 24 Goollama run qwen2.5:32b-instruct-q4_K_M pour exploiter la carte à sa juste valeur.
#3. Benchmarks tokens/sec
RTX 3090 (non Ti) — Q4_K_M standard
| Modèle | Tokens/sec |
|---|---|
| Mistral 7B | 78 t/s |
| Llama 3.1 8B | 68 t/s |
| Phi-4 14B | 42 t/s |
| Qwen 2.5 14B | 40 t/s |
| Mistral Small 24B | 28 t/s |
| Qwen 2.5 32B | 22 t/s |
i
3090 vs 3090 Ti : ~8-12 % d'écart
La 3090 Ti est 8-12 % plus rapide que la 3090 sur LLM (+8 % de CUs, +8 % de bande passante). Pour 150-200 € d'écart en occasion, le rapport perf/€ va à la 3090 classique.
#4. Refroidissement et bruit
- TDP élevé (350 W)
- Ventilateurs audibles en charge soutenue LLM. Nettement plus bruyante qu'une 4090 ou 5080 à perf LLM comparable.
- Undervolt obligatoire pour silence
- Via MSI Afterburner : -120 mV. -15 % TDP, -2 % perf LLM. -6 à -8 dB.
- Boîtier bien aéré indispensable
- 3 ventilateurs in, 1 out mini. Fractal Meshify, Lian Li Lancool, NZXT H7 Flow.
- Température VRAM
- Les GDDR6X de la 3090 sont réputées chaudes (90+ °C). Thermal pads additionnels souvent nécessaires en 2026 pour une carte d'occasion.
#5. 3090 vs 4090 vs 5090
Les trois flagships NVIDIA 24 Go+
| Carte | VRAM | Bande p. | Mistral 7B | Llama 70B Q4 | Prix 2026 |
|---|---|---|---|---|---|
| RTX 3090 | 24 Go | 936 Go/s | 78 t/s | 5-8 t/s | ~800 € occ. |
| RTX 4090 | 24 Go | 1008 Go/s | 110 t/s | 7-10 t/s | ~1800 € occ. |
| RTX 5090 | 32 Go | 1792 Go/s | 138 t/s | 22-28 t/s | ~2500 € neuf |
#Meilleur rapport VRAM/€ en 2026
- Achetez une RTX 3090 occasion si
- Budget 700-850 €, usage LLM intensif, vitesse secondaire face à capacité. Vous obtenez 24 Go VRAM pour 3× moins qu'une 5090.
- Vérifications avant achat
- Thermal pads neufs (VRAM), tests 3DMark Time Spy stable, pas de flags « ex-mining » sans docs, garantie vendeur mini 6 mois.
- Préférez 4090 si budget ≥ 1500 €
- +40 % vitesse, moins gourmande, plus silencieuse.
- Préférez 5070 Ti neuve si usage ≤ 14B
- 16 Go neuf, +20 % vitesse, garantie, FP4.
#Questions fréquentes
La RTX 3090 peut-elle faire tourner Llama 3.3 70B ?+
Oui, avec compromis. Q2_K (26 Go) : offload 2 Go RAM → 5-8 tok/s (usable). IQ2_XS (21 Go) : tout VRAM → 12-16 tok/s mais qualité dégradée. Pour 70B confortable, préférez une 5090.
Quelle est la différence entre RTX 3090 et 3090 Ti pour LLM ?+
~8-12 % de vitesse en faveur de la Ti. +100 W de TDP. +150-200 € d'écart. Pour pur LLM, la 3090 classique offre meilleur rapport perf/€.
RTX 3090 ou RTX 4070 Ti Super 16 Go pour LLM ?+
Dépend de l'usage. 3090 (24 Go) : accès 32B et 70B offload. 4070 Ti Super (16 Go) : perfs LLM 14B équivalentes ou légèrement meilleures, plus silencieuse, moins gourmande. Si vous visez 24-32B+, 3090. Sinon, 4070 Ti Super.
Est-il risqué d'acheter une RTX 3090 ex-mining ?+
Pas forcément si vérifié. Le mining mettait surtout la VRAM à contribution (chauffe), pas le GPU. Demandez thermal pads remplacés, pâte thermique refaite, tests benchmarks stables. Prix ~100-150 € de moins vs gaming.
Quelle alim pour RTX 3090 ?+
850 W de qualité minimum (ATX 2.0 OK). TDP 350 W + CPU 150 W + système = ~550 W nominal, mais pics transitoires élevés (jusqu'à 500 W GPU seul). Marge 30 % recommandée.
Peut-on faire du fine-tuning LoRA sur RTX 3090 ?+
Oui, très bien. LoRA sur 8B : confortable. QLoRA sur Mistral Small 24B : ~20 Go, jouable. QLoRA sur 70B : serré, batch 1, unsloth recommandé.
La RTX 3090 supporte-t-elle Flash Attention ?+
Oui, FA2 supporté depuis les pilotes 525. Gain ~8 % sur contextes longs. FA3 nécessite Ada/Blackwell, pas disponible sur Ampere.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.