Intermédiaire 12 minRTX 30

Quel LLM sur RTX 3090 / 3090 Ti (24 Go) ?

La RTX 3090 (septembre 2020) et la 3090 Ti (mars 2022) sont devenues en 2026 les meilleures affaires LLM grand public. 24 Go de VRAM GDDR6X, 936 à 1008 Go/s de bande passante, 10 496 / 10 752 cœurs CUDA Ampere. Désormais à 700-850 € en occasion (3090) et 900-1000 € (3090 Ti), elles font tourner Qwen 32B Q4, DeepSeek-Coder 33B et même Llama 70B en offload léger. Ce guide détaille pourquoi c'est encore un choix très pertinent en 2026.

Par Mohamed Meguedmi·Màj 2026-04-18·Testé sur Windows, macOS, Linux

#RTX 3090 et 3090 Ti en 2026

Architecture
Ampere GA102. TSMC Samsung 8nm (moins efficient qu'Ada).
VRAM
24 Go GDDR6X 19,5 Gbps (3090) / 21 Gbps (Ti). Bande passante 936 / 1008 Go/s.
Cœurs CUDA
10 496 (3090) / 10 752 (Ti).
TDP
350 W (3090) / 450 W (Ti). Alim 850 W mini.
Prix 2026
3090 : 700-850 €. 3090 Ti : 900-1000 €. Prix en baisse lente.
Le meilleur rapport 24 Go/€ du marché en 2026
Pour 700-850 €, c'est 3× moins cher qu'une RTX 5090 et 2× moins qu'une 4090 occasion, avec les mêmes 24 Go de VRAM. Vous perdez 30-40 % en vitesse brute vs 4090 mais gagnez la capacité — le critère qui compte pour le LLM.

#1. Modèles compatibles 24 Go

Modèles LLM — RTX 3090 / 3090 Ti 24 Go
ModèleQuantVRAMTokens/sec (3090)Usage
Mistral 7BQ5_K_M5,1 Go72-82Chat rapide
Llama 3.1 8BQ6_K6,7 Go64-74Chat + RAG FR
Qwen 2.5 Coder 14BQ6_K11,7 Go40-48Code pro
Phi-4 14BQ8_015 Go34-40Reasoning qualité
Mistral Small 24BQ6_K20 Go22-28Polyvalent
Qwen 2.5 32BQ5_K_M23 Go18-22Reasoning avancé
DeepSeek-Coder 33BQ4_K_M19 Go20-26Code multi-fichiers
Llama 3.3 70BQ2_K26 Go5-8Offload léger, usable
Llama 3.3 70BIQ2_XS21 Go12-16VRAM only

#2. Installation

  1. 01
    Drivers NVIDIA 535+
    Standard Ampere.
  2. 02
    Ollama
    Installation depuis ollama.com. Auto-détection GPU.
  3. 03
    Premier modèle 24 Go
    ollama run qwen2.5:32b-instruct-q4_K_M pour exploiter la carte à sa juste valeur.

#3. Benchmarks tokens/sec

RTX 3090 (non Ti) — Q4_K_M standard
ModèleTokens/sec
Mistral 7B78 t/s
Llama 3.1 8B68 t/s
Phi-4 14B42 t/s
Qwen 2.5 14B40 t/s
Mistral Small 24B28 t/s
Qwen 2.5 32B22 t/s
i
3090 vs 3090 Ti : ~8-12 % d'écart
La 3090 Ti est 8-12 % plus rapide que la 3090 sur LLM (+8 % de CUs, +8 % de bande passante). Pour 150-200 € d'écart en occasion, le rapport perf/€ va à la 3090 classique.

#4. Refroidissement et bruit

TDP élevé (350 W)
Ventilateurs audibles en charge soutenue LLM. Nettement plus bruyante qu'une 4090 ou 5080 à perf LLM comparable.
Undervolt obligatoire pour silence
Via MSI Afterburner : -120 mV. -15 % TDP, -2 % perf LLM. -6 à -8 dB.
Boîtier bien aéré indispensable
3 ventilateurs in, 1 out mini. Fractal Meshify, Lian Li Lancool, NZXT H7 Flow.
Température VRAM
Les GDDR6X de la 3090 sont réputées chaudes (90+ °C). Thermal pads additionnels souvent nécessaires en 2026 pour une carte d'occasion.

#5. 3090 vs 4090 vs 5090

Les trois flagships NVIDIA 24 Go+
CarteVRAMBande p.Mistral 7BLlama 70B Q4Prix 2026
RTX 309024 Go936 Go/s78 t/s5-8 t/s~800 € occ.
RTX 409024 Go1008 Go/s110 t/s7-10 t/s~1800 € occ.
RTX 509032 Go1792 Go/s138 t/s22-28 t/s~2500 € neuf

#Meilleur rapport VRAM/€ en 2026

Achetez une RTX 3090 occasion si
Budget 700-850 €, usage LLM intensif, vitesse secondaire face à capacité. Vous obtenez 24 Go VRAM pour 3× moins qu'une 5090.
Vérifications avant achat
Thermal pads neufs (VRAM), tests 3DMark Time Spy stable, pas de flags « ex-mining » sans docs, garantie vendeur mini 6 mois.
Préférez 4090 si budget ≥ 1500 €
+40 % vitesse, moins gourmande, plus silencieuse.
Préférez 5070 Ti neuve si usage ≤ 14B
16 Go neuf, +20 % vitesse, garantie, FP4.

#Questions fréquentes

La RTX 3090 peut-elle faire tourner Llama 3.3 70B ?+
Oui, avec compromis. Q2_K (26 Go) : offload 2 Go RAM → 5-8 tok/s (usable). IQ2_XS (21 Go) : tout VRAM → 12-16 tok/s mais qualité dégradée. Pour 70B confortable, préférez une 5090.
Quelle est la différence entre RTX 3090 et 3090 Ti pour LLM ?+
~8-12 % de vitesse en faveur de la Ti. +100 W de TDP. +150-200 € d'écart. Pour pur LLM, la 3090 classique offre meilleur rapport perf/€.
RTX 3090 ou RTX 4070 Ti Super 16 Go pour LLM ?+
Dépend de l'usage. 3090 (24 Go) : accès 32B et 70B offload. 4070 Ti Super (16 Go) : perfs LLM 14B équivalentes ou légèrement meilleures, plus silencieuse, moins gourmande. Si vous visez 24-32B+, 3090. Sinon, 4070 Ti Super.
Est-il risqué d'acheter une RTX 3090 ex-mining ?+
Pas forcément si vérifié. Le mining mettait surtout la VRAM à contribution (chauffe), pas le GPU. Demandez thermal pads remplacés, pâte thermique refaite, tests benchmarks stables. Prix ~100-150 € de moins vs gaming.
Quelle alim pour RTX 3090 ?+
850 W de qualité minimum (ATX 2.0 OK). TDP 350 W + CPU 150 W + système = ~550 W nominal, mais pics transitoires élevés (jusqu'à 500 W GPU seul). Marge 30 % recommandée.
Peut-on faire du fine-tuning LoRA sur RTX 3090 ?+
Oui, très bien. LoRA sur 8B : confortable. QLoRA sur Mistral Small 24B : ~20 Go, jouable. QLoRA sur 70B : serré, batch 1, unsloth recommandé.
La RTX 3090 supporte-t-elle Flash Attention ?+
Oui, FA2 supporté depuis les pilotes 525. Gain ~8 % sur contextes longs. FA3 nécessite Ada/Blackwell, pas disponible sur Ampere.
Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.