Débutant 9 minIDE

Claude Code gratuit ? Prix, options et modèles locaux

Claude Code gratuit ? Non, pas dans sa forme standard : l'agent de code d'Anthropic s'installe sans payer, mais il ne fonctionne qu'avec un abonnement payant ou un compte API facturé à l'usage. Ce guide détaille ce qui est gratuit ou non, compare l'abonnement et la facturation au token, puis passe en revue les vraies options pour payer moins, dont le branchement d'un modèle local via Ollama. La configuration technique, elle, est traitée dans un tutoriel séparé.

Par Thomas P.·Màj 2026-10-10·Testé sur Windows, macOS, Linux

#Claude Code gratuit : la réponse courte

Claude Code est un agent de code : un programme en ligne de commande, avec des extensions pour VS Code et les IDE JetBrains, qui lit votre dépôt, modifie des fichiers, lance des commandes et corrige ses erreurs. Le programme lui-même se télécharge et s'installe gratuitement. Mais il ne fait rien seul : chaque action passe par un modèle Claude hébergé chez Anthropic, et c'est cet accès au modèle qui se paie.

Le plan gratuit de Claude.ai donne accès au chat web, pas à Claude Code. Pour utiliser l'agent, il faut soit un abonnement payant (Pro, Max, Team ou Enterprise), soit un compte API sur la Console Anthropic, facturé au nombre de tokens consommés. Il n'existe pas de version gratuite permanente de Claude Code avec les modèles Claude.

Le logiciel
Gratuit. Installation par npm, par script ou via les extensions d'éditeur, sans paiement.
Les modèles Claude
Payants. Soit inclus dans un abonnement avec des limites d'usage, soit facturés au token via l'API.
Le plan gratuit de Claude.ai
Ne couvre pas Claude Code. Il sert au chat dans le navigateur ou l'application.
Un modèle local à la place de Claude
Possible et sans abonnement : Claude Code accepte un serveur compatible, Ollama en fournit un. La qualité n'est pas celle des modèles Claude.
i
Ce que ce guide couvre
La question du prix et les options pour le réduire. La configuration pas à pas d'Ollama dans Claude Code est dans notre tutoriel dédié, lié en fin de page. Ce guide ne compare pas non plus les agents de code entre eux.

#Ce qui est gratuit et ce qui est payant chez Anthropic

Le kit Copilote Local

Ce guide t'amène au modèle. Le kit t'amène au copilote qui code dans ton éditeur.

  • Espace en ligne à vie
  • PDF + fichiers
  • Mises à jour à vie

Anthropic vend l'accès à ses modèles de deux manières distinctes, et Claude Code peut s'appuyer sur l'une ou l'autre. La distinction compte, parce que la facture n'a pas du tout la même forme selon le chemin choisi.

Plan gratuit Claude.ai
Chat limité dans le navigateur et l'application. Pas d'accès à Claude Code, pas d'accès API.
Abonnements Pro et Max
Forfait mensuel pour une personne. Claude Code est inclus, dans la limite d'un volume d'usage qui se renouvelle par fenêtre de quelques heures, avec un plafond hebdomadaire. Max est un palier supérieur de Pro, avec un volume plusieurs fois plus élevé.
Abonnements Team et Enterprise
Même logique, facturés par siège, avec administration centralisée. Claude Code y est accessible selon les options du contrat.
API via la Console Anthropic
Pas de forfait : vous payez chaque million de tokens lus et chaque million de tokens produits. Le tarif dépend du modèle (les petits modèles coûtent moins cher que les grands) et les tokens de sortie coûtent plus cher que les tokens d'entrée.
!
Les montants changent : lisez la page officielle
Nous ne recopions volontairement pas les tarifs ici. Anthropic les modifie, ajoute des paliers et change la liste des modèles sans prévenir. Seule la page tarifs d'Anthropic, liée en fin de guide, fait foi le jour où vous décidez. Ordre de grandeur, déjà cité dans notre guide Ollama + Claude Code : l'abonnement d'entrée se situe autour de vingt dollars par mois. Les prix sont affichés en dollars, hors taxes ; la TVA s'ajoute selon votre pays.

Un point qui surprend souvent : avec un abonnement, le compte est le même que pour Claude.ai. Vous vous connectez dans Claude Code avec votre identifiant Claude, et le volume consommé par l'agent se partage avec vos conversations dans le chat. Avec l'API, vous créez une clé dans la Console, vous ajoutez du crédit, et chaque session de Claude Code débite ce crédit.

#Abonnement ou API : laquelle coûte le moins ?

La réponse dépend du volume. Un agent de code consomme beaucoup plus de tokens qu'un chat : à chaque tour, il renvoie au modèle l'historique de la conversation, le contenu des fichiers lus et les résultats des commandes. Sur un dépôt de taille moyenne, une seule tâche de refactorisation représente facilement plusieurs centaines de milliers de tokens d'entrée. Facturé au token, ce volume se voit sur la facture ; dans un abonnement, il est absorbé par le forfait jusqu'à la limite de la fenêtre.

Usage occasionnel
Quelques sessions par semaine, sur des projets personnels : l'abonnement d'entrée suffit en général, et son plafond protège d'une mauvaise surprise.
Usage quotidien soutenu
L'agent tourne toute la journée : l'abonnement reste prévisible, mais les limites de fenêtre se font sentir. Max ou l'API deviennent les deux options à comparer sur votre propre volume.
Équipe
Team ou Enterprise pour la gestion des sièges et la facturation unique ; l'API pour des outils internes partagés.
Automatisation
Scripts, intégration continue, Agent SDK : ces usages passent par l'API et une clé, pas par un abonnement personnel.

Avec l'API, Claude Code affiche la dépense de la session en cours. Avec un abonnement, il affiche l'état des limites. Ces deux commandes sont le premier réflexe avant de chercher à réduire le coût : on ne réduit bien que ce que l'on mesure.

Dans une session Claude Code
/cost     # dépense de la session (facturation API)
/usage    # limites restantes de l'abonnement
/compact  # résume la conversation pour alléger le contexte
/model    # change de modèle (un modèle plus petit coûte moins cher)
→
Le cache de prompt joue pour vous
L'API Anthropic facture moins cher les tokens d'entrée déjà envoyés et mis en cache. Claude Code en profite automatiquement sur l'historique de session. Concrètement, enchaîner des tâches dans une même session coûte moins que relancer l'agent à froid sur le même contexte, tant que la conversation reste raisonnable.

#Réduire la facture sans quitter Claude Code

Avant de changer d'outil, plusieurs réglages réduisent la consommation de tokens, donc le coût à l'API ou la vitesse à laquelle un abonnement atteint sa limite. Ils ne demandent aucune installation.

  1. 01
    Choisir le modèle selon la tâche
    Les modèles Claude n'ont pas le même prix. Renommer des variables, écrire un test unitaire ou expliquer une fonction ne demande pas le modèle le plus cher. Passez au modèle le plus petit avec /model pour ces tâches, et revenez au grand modèle pour l'architecture ou le débogage difficile.
  2. 02
    Limiter ce que l'agent lit
    Chaque fichier lu entre dans le contexte et y reste jusqu'à la fin de la session. Donnez des consignes précises (« modifie uniquement le module paiement »), évitez de lancer l'agent sur un dépôt géant sans cadrage, et gardez un fichier CLAUDE.md court : il est injecté à chaque tour.
  3. 03
    Nettoyer la session
    Lancez /clear entre deux tâches sans rapport, et /compact quand une longue conversation continue. Un historique de deux heures renvoyé à chaque message est le premier poste de dépense.
  4. 04
    Préférer l'abonnement si l'usage est régulier
    Un forfait plafonne la dépense. Si vous constatez à l'API une facture mensuelle supérieure au prix d'un abonnement, basculez. L'inverse est vrai aussi : un usage rare se paie moins cher au token.
  5. 05
    Passer par un fournisseur cloud déjà sous contrat
    Claude Code fonctionne officiellement avec les modèles Claude servis par Amazon Bedrock, Google Vertex AI et Microsoft Foundry. Si votre entreprise a déjà des crédits ou un engagement chez l'un d'eux, la facture passe par ce compte, aux conditions du fournisseur.
  6. 06
    Déléguer une partie du travail à un modèle local
    C'est l'option la plus radicale : zéro abonnement pour les tâches confiées au modèle local. Elle a ses limites, détaillées dans la section suivante.

#Claude Code avec un modèle local : ce que ça change

Claude Code parle à son modèle par l'API Messages d'Anthropic. Depuis ses versions récentes, Ollama expose une API compatible avec ce format, et Claude Code accepte une adresse de serveur alternative via la variable ANTHROPIC_BASE_URL. Résultat : vous gardez l'interface, les commandes et le fonctionnement de Claude Code, mais le modèle qui répond est un modèle à poids ouverts téléchargé sur votre machine. Aucun token ne part chez Anthropic, aucun abonnement n'est nécessaire.

Méthode rapide avec un Ollama récent
ollama launch claude
# Ollama propose un modèle, puis démarre Claude Code branché dessus

La documentation d'Ollama décrit aussi la méthode manuelle par variables d'environnement, utile pour un script ou un alias. Notre tutoriel Ollama dans Claude Code et Cursor la détaille, avec le choix du modèle et les réglages de contexte ; nous ne la répétons pas ici.

!
Ce n'est pas Claude
Un modèle local de 9 à 30 milliards de paramètres, en quantification Q4, n'atteint pas le niveau des modèles Claude sur les tâches d'agent longues : enchaîner dix appels d'outils dépendants, tenir un fil sur un dépôt entier, corriger une erreur subtile. Il tient bien les tâches courtes et cadrées. Promettre une équivalence serait faux ; le bon usage est hybride.
Ce que vous gagnez
Plus d'abonnement pour les tâches confiées au local, aucune donnée envoyée à un tiers, fonctionnement hors ligne, pas de limite de fenêtre.
Ce que vous perdez
La qualité des modèles Claude sur le raisonnement long, le contexte de plusieurs centaines de milliers de tokens, et la connaissance des bibliothèques les plus récentes.
Ce que vous payez quand même
Le matériel et l'électricité. Une carte graphique sous charge pendant des heures se voit sur la facture d'énergie, même si l'ordre de grandeur reste bien en dessous d'un abonnement.
Le modèle doit gérer les outils
Claude Code repose sur les appels d'outils (lire, éditer, exécuter). Un modèle sans cette capacité rend l'agent inutilisable. Les familles citées sur ce site pour le code, Qwen3-Coder, Devstral, gpt-oss et GLM Flash, la gèrent.

Côté matériel, les repères du site s'appliquent : un modèle de 7 milliards de paramètres en Q4 occupe environ 5 Go de mémoire vidéo, un 14B environ 9 Go, un 32B environ 19 Go, sans compter le contexte. Une RTX 3060 de 12 Go est le plancher utile pour un agent de code ; une carte de 16 à 24 Go ou un Mac à mémoire unifiée ouvrent les modèles de 24 à 30B, nettement plus à l'aise en mode agent. Un contexte large, 32 000 tokens et plus, est nécessaire pour qu'un agent lise plusieurs fichiers ; il consomme de la mémoire en plus du modèle.

i
Un modèle « cloud » d'Ollama n'est pas local
Le sélecteur d'Ollama propose aussi des modèles dont le nom se termine par cloud. Ils tournent sur les serveurs d'Ollama, avec un palier gratuit limité puis une offre payante. Pratique pour essayer un très gros modèle, mais vos données partent à l'extérieur et le coût revient. Notre guide sur Ollama Cloud en détaille les limites.

#Fournisseurs compatibles : payer moins sans matériel

Entre l'abonnement Anthropic et le modèle local, une troisième voie existe : garder Claude Code, mais le brancher sur un autre serveur distant que celui d'Anthropic. Trois familles de fournisseurs se présentent, avec des garanties très différentes.

Les clouds officiellement pris en charge
Amazon Bedrock, Google Vertex AI et Microsoft Foundry servent les vrais modèles Claude. Claude Code les prend en charge nativement ; la facturation suit le compte cloud. Même qualité, autre facture, et parfois une localisation des données choisie.
Les hébergeurs de modèles à poids ouverts
Plusieurs éditeurs de modèles ouverts (GLM de Z.ai, Kimi de Moonshot, DeepSeek, MiniMax, entre autres) exposent une API au format Anthropic et documentent son usage avec Claude Code, à des tarifs généralement inférieurs. Ce n'est plus Claude qui répond : la qualité est celle du modèle choisi, et les serveurs sont souvent hors Union européenne.
Les passerelles d'entreprise
Un proxy comme LiteLLM, placé devant plusieurs fournisseurs, permet de router chaque requête vers le modèle le moins cher qui convient, avec un suivi des coûts par équipe. Claude Code s'y connecte comme à n'importe quel serveur compatible.

Avant de confier votre code à un fournisseur compatible, vérifiez cinq points : la compatibilité réelle avec l'API Messages et les appels d'outils, la taille de contexte acceptée, le pays d'hébergement et les conditions d'utilisation des données, le prix par million de tokens en entrée et en sortie, et l'existence d'un plafond de dépense. Un tarif bas sans plafond reste un risque.

!
Code confidentiel : lisez les conditions
Un fournisseur moins cher peut conserver vos requêtes ou les utiliser pour entraîner ses modèles. Pour du code sous accord de confidentialité ou soumis au RGPD, la seule option sans transfert de données est le modèle local ; à défaut, un cloud avec hébergement européen et un contrat clair.

#Alternatives gratuites à Claude Code

Si l'objectif est un agent de code sans abonnement, plutôt que Claude Code en particulier, des outils ouverts font le même travail avec un modèle local. Ils sont gratuits au sens strict : pas de licence, pas de forfait. Reste le matériel.

OpenCode + Ollama
Agent de code dans le terminal, open source, très proche de Claude Code dans l'usage. Ollama sait le lancer directement avec un modèle local. Voir notre guide OpenCode + Ollama.
Cline + Ollama
Agent de code dans VS Code, avec mode plan et mode exécution. Notre guide Cline + Ollama détaille la configuration et les modèles qui conviennent selon la mémoire vidéo.
Alternatives locales à Copilot
Pour la complétion de code dans l'éditeur, Tabby et CodeGeeX complètent Cline. Voir notre guide sur les alternatives gratuites à Copilot.
API gratuites avec quotas
Certains fournisseurs offrent un volume gratuit, limité et parfois en échange de vos données. Notre comparatif des API LLM gratuites explique où elles s'arrêtent et quand le local devient plus sain.

Le mot « gratuit » demande une précision. Un agent local sur une carte de 12 Go fonctionne sans aucune dépense mensuelle, mais il consomme de l'électricité et suppose un ordinateur déjà équipé. Si l'achat d'une carte graphique est nécessaire, comparez son prix à plusieurs années d'abonnement avant de décider ; le calcul n'est pas le même pour un usage de loisir et pour un usage professionnel quotidien.

#Quelle option pour vous : grille de décision

Vous voulez essayer Claude Code sans payer
Installez-le, branchez-le sur Ollama avec un modèle de code de 9 à 14B. Vous découvrez l'interface et le fonctionnement d'un agent ; vous ne jugez pas la qualité de Claude.
Développeur indépendant, usage régulier
Abonnement Pro, puis Max si les limites gênent. Un modèle local en parallèle pour les tâches simples et le travail hors ligne.
Code confidentiel ou client sous accord de non-divulgation
Modèle local pour ce dépôt, Claude Code ou OpenCode au choix. Le cloud pour le reste.
Équipe de plusieurs personnes
Team ou Enterprise, ou un cloud déjà sous contrat (Bedrock, Vertex, Foundry) avec Claude Code branché dessus. Une passerelle si vous voulez un suivi des coûts par projet.
Petit budget, carte de 12 Go
Agent local avec un modèle de 9B en Q4, en acceptant ses limites. Abonnement d'entrée le mois où un projet exige mieux.
Pas de carte graphique
Abonnement, ou fournisseur compatible après vérification des conditions. Un modèle local sur processeur seul est trop lent pour un agent de code.

#Questions fréquentes

Claude Code, prix et gratuité
Claude Code est-il gratuit ?+
Le logiciel oui, l'usage non. Claude Code ne fonctionne qu'avec un abonnement Claude payant (Pro, Max, Team, Enterprise) ou un compte API facturé au token. Le plan gratuit de Claude.ai n'y donne pas accès.
Peut-on essayer Claude Code gratuitement ?+
Il n'existe pas d'essai gratuit permanent documenté pour Claude Code avec les modèles Claude ; les opérations promotionnelles éventuelles sont annoncées sur le site d'Anthropic. Le moyen gratuit de tester l'interface est de brancher Claude Code sur un modèle local via Ollama.
Combien coûte Claude Code ?+
Cela dépend du chemin : un forfait mensuel avec l'abonnement, ou une facture proportionnelle aux tokens avec l'API. Les montants évoluent ; la page tarifs d'Anthropic fait foi. Pour un usage régulier, l'abonnement est généralement plus prévisible.
Claude Code avec Ollama, est-ce vraiment gratuit ?+
Oui au sens où il n'y a plus d'abonnement ni de facture au token : Ollama et les modèles à poids ouverts sont gratuits. Vous payez le matériel et l'électricité, et vous perdez la qualité des modèles Claude sur les tâches longues.
Un modèle local vaut-il Claude dans Claude Code ?+
Non. Un modèle de 9 à 30B en Q4 tient les tâches courtes et cadrées, pas les sessions d'agent longues sur un gros dépôt. L'usage raisonnable est hybride : local pour le quotidien et le confidentiel, Claude pour le difficile.
Claude Code fonctionne-t-il hors ligne ?+
Seulement avec un modèle local. Branché sur Ollama, l'agent n'a besoin d'aucune connexion. Avec un abonnement ou l'API, chaque action passe par les serveurs d'Anthropic.

#Pour aller plus loin

Vous savez maintenant ce qui est gratuit ou payant, et quelle option correspond à votre situation. La suite logique est la configuration, traitée dans les guides suivants.

Guide rédigé le 10 octobre 2026. Les règles d'accès (plan gratuit sans Claude Code, abonnements ou API) correspondent à la documentation d'Anthropic ; les montants ne sont pas recopiés ici parce qu'ils changent, et la page tarifs officielle fait foi. La méthode de branchement sur Ollama suit la page d'intégration de la documentation d'Ollama, dont les commandes évoluent d'une version à l'autre.

Ce guide vous a aidé ?

Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.