Accueil Catalogue Meilleur LLM local libre pour usage commercial

Meilleur LLM local libre pour usage commercial

Classement mis à jour le 18/08/2026

Pour un usage commercial (SaaS, produit payant, service interne d'entreprise), seules les licences permissives (Apache 2.0, MIT, BSD) sont réellement tranquilles. On écarte les licences communautaires avec seuils d'utilisateurs, et les licences non-prod.

Classement

1

🇺🇸 Laguna XS.2

Poolside · 33B paramètres · Apache 2.0 · 131 072 tokens ctx

MoE 33B/3B actifs Apache 2.0 spécialiste coding agentic. 68.2% SWE-Bench Verified, 128k ctx. Tourne sur Mac 36 Go. Sortie 28 avril 2026.

Pourquoi ce rang Licence Apache 2.0 — libre pour usage commercial sans restriction. 33B paramètres.
ollama run laguna-xs.2
VRAM Q4
19 GB
35 GB en Q8
2

🇨🇳 GLM 4.7 Flash

Zhipu AI · 31B paramètres · MIT · 128 000 tokens ctx

GLM-4.7-Flash (MoE 31B, ~3B actifs) : le meilleur rapport code/VRAM de la classe 30B. MIT, 128k ctx, très rapide sur 3090/4090.

Pourquoi ce rang Licence MIT — libre pour usage commercial sans restriction. 31B paramètres.
ollama run glm-4.7-flash
VRAM Q4
19 GB
35 GB en Q8
3

🇨🇳 LLaDA 2.0 Uni 16B

Ant Group / inclusionAI · 16B paramètres · Apache 2.0 · 8 192 tokens ctx

Premier dLLM open Apache 2.0 : MoE 16B/1B + décodeur diffusion 6.2B. Texte+vision unifié. Sortie 22 avril 2026.

Pourquoi ce rang Licence Apache 2.0 — libre pour usage commercial sans restriction. 16B paramètres.
# HuggingFace : inclusionAI/LLaDA2.0-Uni (Flash Attn 2 + CUDA 12.4 requis)
VRAM Q4
18 GB
30 GB en Q8
4

🇨🇳 Qwen 3.6 27B

Alibaba · 27B paramètres · Apache 2.0 · 262 144 tokens ctx

Dense 27B multimodal sortie 22 avril 2026. 262k ctx (1M YaRN). SWE-bench Verified 77.2%.

Pourquoi ce rang Licence Apache 2.0 — libre pour usage commercial sans restriction. 27B paramètres.
ollama run qwen3.6:27b
VRAM Q4
16 GB
29 GB en Q8
5

🇨🇳 Qwen 3.8 27B

Alibaba · 27B paramètres · Apache 2.0 · 262 144 tokens ctx

Qwen 3.8 27B : dense multimodal (texte + vision), 262k contexte, ~16 Go VRAM Q4 (18 Go de poids Ollama). Apache 2.0, code agentique et vision.

Pourquoi ce rang Licence Apache 2.0 — libre pour usage commercial sans restriction. 27B paramètres.
ollama run qwen3.8:27b
VRAM Q4
16 GB
29 GB en Q8
6

🇺🇸 Granite 4.1 30B Instruct

IBM · 30B paramètres · Apache 2.0 · 131 072 tokens ctx

Dense 30B Apache 2.0, 12 langues dont FR, 131k ctx, GQA 32Q/8KV. Tool calling OpenAI-compatible. Sortie 29 avril 2026.

Pourquoi ce rang Licence Apache 2.0 — libre pour usage commercial sans restriction. 30B paramètres.
ollama run granite4.1:30b
VRAM Q4
17 GB
32 GB en Q8
7

🇺🇸 DiffusionGemma 26B-A4B Instruct

Google · 26B paramètres · Apache 2.0 · 128 000 tokens ctx

DiffusionGemma 26B (Google) : Gemma vision-langage par diffusion, instruct, 128k contexte, 15 Go VRAM Q4. Apache 2.0. Sortie juin 2026.

Pourquoi ce rang Licence Apache 2.0 — libre pour usage commercial sans restriction. 26B paramètres.
# HuggingFace : google/diffusiongemma-26B-A4B-it
VRAM Q4
15 GB
28 GB en Q8
8

🇺🇸 North Mini Code 1.0

Cohere · 30.5B paramètres · Apache 2.0 · 488 000 tokens ctx

Modèle Cohere de 30,5B orienté coding agentic et raisonnement. Contexte 488k, Apache 2.0, ~18 Go VRAM en Q4.

Pourquoi ce rang Licence Apache 2.0 — libre pour usage commercial sans restriction. 30.5B paramètres.
ollama run north-mini-code-1.0
VRAM Q4
18 GB
33 GB en Q8

Tableau comparatif

Rang Modèle Params VRAM Q4 Contexte Licence
#1 Laguna XS.2 33B 19 GB 131 072 Apache 2.0
#2 GLM 4.7 Flash 31B 19 GB 128 000 MIT
#3 LLaDA 2.0 Uni 16B 16B 18 GB 8 192 Apache 2.0
#4 Qwen 3.6 27B 27B 16 GB 262 144 Apache 2.0
#5 Qwen 3.8 27B 27B 16 GB 262 144 Apache 2.0
#6 Granite 4.1 30B Instruct 30B 17 GB 131 072 Apache 2.0
#7 DiffusionGemma 26B-A4B Instruct 26B 15 GB 128 000 Apache 2.0
#8 North Mini Code 1.0 30.5B 18 GB 488 000 Apache 2.0

Méthodologie du classement

Filtre strict : licence contient Apache, MIT ou BSD. Pas de Llama Community (seuil 700M MAU), pas de Mistral NPL, pas de Gemma (licence custom permissive mais avec clauses d'usage acceptable).

Critères pris en compte :

  • Licence Apache 2.0 / MIT / BSD
  • Aucune clause d'usage restrictive
  • Compatible SaaS
  • Poids librement redistribuables

Le scoring est entièrement transparent : consultez notre méthodologie pour les détails de calcul VRAM/tokens/sec.

Questions fréquentes

Llama 3.3 70B est-il libre commercialement ?

Non, Llama 3.3 est sous "Llama 3.3 Community License" — libre sauf si votre produit dépasse 700M MAU. Pour un produit grand public futur, c'est un risque. Préférez Qwen (Apache 2.0) ou Mistral (Apache 2.0 sur les modèles Open).

Et Gemma de Google ?

Gemma est sous "Gemma License" — permissive mais avec clause d'usage acceptable (pas pour armes, surveillance de masse, etc.). Pour la plupart des usages B2B, c'est OK, mais lisez attentivement si votre produit touche à la défense ou à la sécurité.

Puis-je fine-tuner un modèle Apache 2.0 et le revendre ?

Oui — Apache 2.0 permet la modification et la redistribution, y compris commerciale. Vous devez juste garder l'attribution et la licence dans les poids redistribués. Vos propres données d'entraînement restent les vôtres.

Qwen vient de Chine — y a-t-il un risque légal ?

Les modèles Qwen sont publiés sous Apache 2.0 par Alibaba Cloud. La licence est valide internationalement. Pour des usages très sensibles (défense, santé), certaines entreprises préfèrent Mistral (🇫🇷) ou IBM Granite (🇺🇸) pour la traçabilité de provenance.

Pour aller plus loin