OpenRouter : c'est quoi, combien ça coûte, et le local ?
OpenRouter est un service en ligne qui donne accès à des centaines de modèles d'IA, propriétaires et ouverts, à travers une seule API et un seul compte. Au lieu d'ouvrir un compte chez chaque fournisseur, vous achetez des crédits une fois et choisissez le modèle à chaque requête. Au 20 septembre 2026, c'est la passerelle la plus utilisée par les développeurs et par les outils de code comme Cline ou OpenCode. Cette page explique ce que fait le service, ce qu'il coûte, où passent vos données, et dans quels cas un modèle sur votre propre machine reste le meilleur choix.
#OpenRouter, c'est quoi ?
OpenRouter est une passerelle d'API. La société, fondée en 2023, n'entraîne pas de modèles et n'en héberge pas elle-même pour l'essentiel : elle se place entre votre application et les fournisseurs, qu'il s'agisse des laboratoires comme OpenAI, Anthropic, Google ou Mistral, ou des hébergeurs qui servent les modèles à poids ouverts comme Qwen, Llama ou DeepSeek.
Son API reprend le format d'OpenAI. Une application déjà écrite pour OpenAI fonctionne en changeant deux lignes : l'adresse de base et la clé. Le modèle se choisit par un simple nom, de la forme fournisseur/modèle, ce qui permet de passer de l'un à l'autre sans toucher au reste du code.
#Comment ça marche
Ton ChatGPT privé et gratuit sur ta machine en 1 heure — LM Studio, Ollama, Open WebUI, tes documents, sans cloud.
- Espace en ligne à vie
- PDF + fichiers
- Remboursé 30 j
- Un catalogue unique
- Chaque modèle a sa fiche : prix par million de tokens en entrée et en sortie, taille du contexte, fournisseurs qui le servent, débit et latence observés.
- Le routage entre fournisseurs
- Un même modèle ouvert est souvent servi par plusieurs hébergeurs à des prix et des vitesses différents. OpenRouter choisit selon vos préférences (prix, débit, latence) et bascule sur un autre fournisseur si le premier est en panne.
- Les replis entre modèles
- Vous pouvez indiquer une liste de modèles de secours : si le premier est indisponible ou refuse la requête, le suivant prend le relais.
- Votre propre clé
- Si vous avez déjà un compte chez un fournisseur, vous pouvez brancher votre clé et garder OpenRouter comme point d'entrée unique.
#Ce que ça coûte
Le modèle économique est le prépaiement. Vous achetez des crédits, et chaque requête est débitée au tarif du fournisseur, sans marge sur le prix du token. OpenRouter se rémunère par une commission prélevée à l'achat des crédits. Il n'y a ni abonnement ni engagement.
| Poste | Ce qu'il faut savoir |
|---|---|
| Prix des tokens | Celui du fournisseur, affiché sur la fiche du modèle. La sortie coûte plusieurs fois plus cher que l'entrée. |
| Commission | Prélevée une fois, à l'achat des crédits. Vérifiez le taux en vigueur sur le site avant de recharger. |
| Modèles gratuits | Certains modèles ouverts existent en variante gratuite, repérable au suffixe « :free ». Ils sont limités en nombre de requêtes par jour et servis sans garantie de disponibilité. |
| Modèles de raisonnement | Les tokens de réflexion, invisibles, sont facturés comme de la sortie. La facture peut être plusieurs fois supérieure à ce que laisse penser la longueur de la réponse. |
- Estimer votre facture d'API selon votre usage
- API LLM gratuites : le vrai comparatif, et l'option locale
#L'utiliser en cinq minutes
- 01Créer un compte et une clé
- 02Ajouter des crédits
- 03Pointer votre outil vers l'API
Le nom exact de chaque modèle figure sur sa fiche. Pour les modèles ouverts, c'est en général le même que sur Hugging Face, en minuscules.
#Où vont vos données
C'est la question à se poser avant d'y brancher un outil professionnel. Une requête traverse deux acteurs : OpenRouter, puis le fournisseur qui exécute le modèle. Chacun a sa politique.
- Côté OpenRouter
- Le service indique ne pas conserver le contenu des prompts par défaut ; une option de journalisation existe, à activer volontairement. Les métadonnées (modèle, nombre de tokens, horodatage) sont conservées pour la facturation.
- Côté fournisseur
- Les politiques varient : certains hébergeurs conservent les requêtes un temps, d'autres s'en servent pour entraîner. Chaque fiche de fournisseur le précise, et un réglage de compte permet d'exclure ceux qui entraînent sur vos données.
- Côté juridique
- Les serveurs sont pour la plupart hors d'Europe. Pour des données personnelles, des dossiers clients ou du code confidentiel, vérifiez ce que votre contrat et le RGPD autorisent avant d'envoyer quoi que ce soit.
#OpenRouter ou un modèle en local ?
| Critère | OpenRouter | Modèle en local |
|---|---|---|
| Mise en route | Cinq minutes, aucun matériel | Une installation, et une carte graphique ou un Mac adapté |
| Taille des modèles | Tout, y compris les modèles de plusieurs centaines de milliards de paramètres | Ce qui tient dans votre mémoire : jusqu'à 30 milliards sur 24 Go, 120 milliards sur un Mac 128 Go |
| Coût | À l'usage, variable, sans plafond naturel | Le matériel une fois, puis l'électricité |
| Confidentialité | Vos données passent par deux tiers | Rien ne quitte la machine |
| Disponibilité | Dépend du réseau et des fournisseurs | Fonctionne hors ligne |
| Limites de débit | Oui, surtout sur les variantes gratuites | Aucune |
| Modèles propriétaires | Oui | Non |
Beaucoup des modèles ouverts proposés sur OpenRouter sont exactement ceux que vous pouvez faire tourner chez vous. Dans le catalogue QuelLLM, Qwen 3 14B pèse 9 Go en Q4, gpt-oss 20B 13 Go, Mistral Small 3.2 24B 14 Go : une carte de 16 Go les fait tourner sans facture ni limite. OpenRouter devient pertinent pour ce qui ne tient pas chez vous, ou pour un usage trop occasionnel pour justifier du matériel.
- Ce modèle tient-il sur ma machine ? Le calculateur de VRAM
- IA locale ou service en ligne : le comparatif
#Utiliser les deux ensemble
Le montage le plus rationnel combine les deux. Un modèle local traite le quotidien et tout ce qui est confidentiel ; une passerelle cloud prend le relais, à la demande, pour les tâches qui exigent un très grand modèle. Un proxy comme LiteLLM présente l'ensemble derrière une seule adresse, avec des règles de routage et un budget.
- LiteLLM : un proxy unifié pour le local et le cloud
- OpenCode + Ollama : un agent de code sans facture d'API
- Documentation officielle d'OpenRouter
#FAQ
OpenRouter est-il gratuit ?+
OpenRouter est-il fiable et sûr ?+
Quelle différence entre OpenRouter et Ollama ?+
OpenRouter est-il plus cher que d'aller directement chez le fournisseur ?+
Peut-on utiliser OpenRouter avec Cline, OpenCode ou Open WebUI ?+
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.