Intermédiaire 12 minRTX 30
Quel LLM sur RTX 3090 / 3090 Ti (24 Go) ?
La RTX 3090 (septembre 2020) et la 3090 Ti (mars 2022) sont devenues en 2026 les meilleures affaires LLM grand public. 24 Go de VRAM GDDR6X, 936 à 1008 Go/s de bande passante, 10 496 / 10 752 cœurs CUDA Ampere. Désormais à 700-850 € en occasion (3090) et 900-1000 € (3090 Ti), elles font tourner Qwen 3.8 27B, Devstral 24B pour le code et même un MoE 30B comme Qwen3-Coder 30B en Q8 via offload léger. Ce guide détaille pourquoi c'est encore un choix très pertinent en 2026.
#RTX 3090 et 3090 Ti en 2026
- Architecture
- Ampere GA102. TSMC Samsung 8nm (moins efficient qu'Ada).
- VRAM
- 24 Go GDDR6X 19,5 Gbps (3090) / 21 Gbps (Ti). Bande passante 936 / 1008 Go/s.
- Cœurs CUDA
- 10 496 (3090) / 10 752 (Ti).
- TDP
- 350 W (3090) / 450 W (Ti). Alim 850 W mini.
- Prix 2026
- 3090 : 700-850 €. 3090 Ti : 900-1000 €. Prix en baisse lente.
→
Le meilleur rapport 24 Go/€ du marché en 2026
Pour 700-850 €, c'est 3× moins cher qu'une RTX 5090 et 2× moins qu'une 4090 occasion, avec les mêmes 24 Go de VRAM. Vous perdez 30-40 % en vitesse brute vs 4090 mais gagnez la capacité — le critère qui compte pour le LLM.
#1. Modèles compatibles 24 Go
Modèles LLM — RTX 3090 / 3090 Ti 24 Go
| Modèle | Quant | VRAM | Tokens/sec (3090) | Usage |
|---|---|---|---|---|
| gpt-oss 20B | Q4_K_M | 13 Go | 50-61 | Chat rapide |
| Devstral Small 2 24B | Q4_K_M | 14 Go | 14-17 | Chat + RAG FR |
| Qwen 3.6 27B | Q4_K_M | 16 Go | 12-14 | Code pro |
| Gemma 4 12B | Q8_0 | 14 Go | 38-44 | Multimodal, vision |
| Mistral Small 24B | Q6_K | 20 Go | 22-28 | Polyvalent |
| GLM 4.7 Flash | Q4_K_M | 19 Go | 36-44 | Reasoning avancé |
| Granite 4.2 30B | Q4_K_M | 18 Go | 11-13 | Usage pro / entreprise |
| Gemma 4 26B-A4B MoE | Q5_K_M | 19 Go | 20-24 | Offload léger, usable |
| Qwen 3.6 35B-A3B | Q4_K_M | 23 Go | 22-26 | MoE rapide, VRAM only |
#2. Installation
- 01Drivers NVIDIA 535+Standard Ampere.
- 02OllamaInstallation depuis ollama.com. Auto-détection GPU.
- 03Premier modèle 24 Goollama run qwen3.8:27b pour exploiter la carte à sa juste valeur (262k ctx, vision). S'il sur-réfléchit, passez son raisonnement en low.
#3. Benchmarks tokens/sec
RTX 3090 (non Ti) — quantifications par défaut, ordres de grandeur
| Modèle | Tokens/sec |
|---|---|
| Granite 4.2 8B | 74 t/s |
| Qwen 3.5 9B | 66 t/s |
| gpt-oss 20B | 55 t/s |
| Gemma 4 12B | 46 t/s |
| Mistral Small 24B | 28 t/s |
| Qwen 3.8 27B | 14 t/s |
i
3090 vs 3090 Ti : ~8-12 % d'écart
La 3090 Ti est 8-12 % plus rapide que la 3090 sur LLM (+8 % de CUs, +8 % de bande passante). Pour 150-200 € d'écart en occasion, le rapport perf/€ va à la 3090 classique.
#4. Refroidissement et bruit
- TDP élevé (350 W)
- Ventilateurs audibles en charge soutenue LLM. Nettement plus bruyante qu'une 4090 ou 5080 à perf LLM comparable.
- Undervolt obligatoire pour silence
- Via MSI Afterburner : -120 mV. -15 % TDP, -2 % perf LLM. -6 à -8 dB.
- Boîtier bien aéré indispensable
- 3 ventilateurs in, 1 out mini. Fractal Meshify, Lian Li Lancool, NZXT H7 Flow.
- Température VRAM
- Les GDDR6X de la 3090 sont réputées chaudes (90+ °C). Thermal pads additionnels souvent nécessaires en 2026 pour une carte d'occasion.
#5. 3090 vs 4090 vs 5090
Les trois flagships NVIDIA 24 Go+
| Carte | VRAM | Bande p. | Qwen 3.5 9B | Qwen3-Coder 30B Q8 | Prix 2026 |
|---|---|---|---|---|---|
| RTX 3090 | 24 Go | 936 Go/s | 66 t/s | 5-8 t/s | ~800 € occ. |
| RTX 4090 | 24 Go | 1008 Go/s | 92 t/s | 7-10 t/s | ~1800 € occ. |
| RTX 5090 | 32 Go | 1792 Go/s | 116 t/s | 22-28 t/s | ~2500 € neuf |
#Meilleur rapport VRAM/€ en 2026
- Achetez une RTX 3090 occasion si
- Budget 700-850 €, usage LLM intensif, vitesse secondaire face à capacité. Vous obtenez 24 Go VRAM pour 3× moins qu'une 5090.
- Vérifications avant achat
- Thermal pads neufs (VRAM), tests 3DMark Time Spy stable, pas de flags « ex-mining » sans docs, garantie vendeur mini 6 mois.
- Préférez 4090 si budget ≥ 1500 €
- +40 % vitesse, moins gourmande, plus silencieuse.
- Préférez 5070 Ti neuve si usage ≤ 14B
- 16 Go neuf, +20 % vitesse, garantie, FP4.
#Questions fréquentes
La RTX 3090 peut-elle faire tourner un 30B en pleine qualité (Q8) ?+
Oui, avec compromis. Qwen3-Coder 30B en Q8 (32 Go) : offload ~8 Go RAM → 5-8 tok/s (usable). En Q4_K_M (19-23 Go) : tout en VRAM → 12-16 tok/s, qualité déjà excellente. Pour du 30B Q8 confortable en pleine VRAM, préférez une 5090 (32 Go).
Quelle est la différence entre RTX 3090 et 3090 Ti pour LLM ?+
~8-12 % de vitesse en faveur de la Ti. +100 W de TDP. +150-200 € d'écart. Pour pur LLM, la 3090 classique offre meilleur rapport perf/€.
RTX 3090 ou RTX 4070 Ti Super 16 Go pour LLM ?+
Dépend de l'usage. 3090 (24 Go) : accès 32B et 70B offload. 4070 Ti Super (16 Go) : perfs LLM 14B équivalentes ou légèrement meilleures, plus silencieuse, moins gourmande. Si vous visez 24-32B+, 3090. Sinon, 4070 Ti Super.
Est-il risqué d'acheter une RTX 3090 ex-mining ?+
Pas forcément si vérifié. Le mining mettait surtout la VRAM à contribution (chauffe), pas le GPU. Demandez thermal pads remplacés, pâte thermique refaite, tests benchmarks stables. Prix ~100-150 € de moins vs gaming.
Quelle alim pour RTX 3090 ?+
850 W de qualité minimum (ATX 2.0 OK). TDP 350 W + CPU 150 W + système = ~550 W nominal, mais pics transitoires élevés (jusqu'à 500 W GPU seul). Marge 30 % recommandée.
Peut-on faire du fine-tuning LoRA sur RTX 3090 ?+
Oui, très bien. LoRA sur 8B : confortable. QLoRA sur Mistral Small 24B : ~20 Go, jouable. QLoRA sur un 30B dense : serré, batch 1, unsloth recommandé.
La RTX 3090 supporte-t-elle Flash Attention ?+
Oui, FA2 supporté depuis les pilotes 525. Gain ~8 % sur contextes longs. FA3 nécessite Ada/Blackwell, pas disponible sur Ampere.
Ce guide vous a aidé ?
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.