LibreChat : l'interface web multi-utilisateurs pour LLM locaux
LibreChat est une interface de conversation web open source, sous licence MIT, qui se place devant n'importe quel modèle : un modèle local servi par Ollama, une API compatible OpenAI, ou plusieurs à la fois dans la même fenêtre. On l'installe chez soi avec Docker, on y crée des comptes, et une équipe dispose d'un outil de discussion assistée sans qu'aucune conversation ne sorte du réseau. Voici ce qu'il faut pour le faire tourner et ce qu'il demande en échange.
#Ce qu'est LibreChat
C'est la moitié « interface » d'une installation locale. Le modèle tourne ailleurs — Ollama, vLLM, llama.cpp — et LibreChat fournit ce qui entoure la conversation : l'historique, les comptes et l'authentification, les préréglages, les fichiers joints, les agents, la recherche dans les échanges passés. Le projet est sous licence MIT, ce qui laisse peu de zones d'ombre sur ce qu'on a le droit d'en faire.
Son parti pris le plus visible est le multi-fournisseur : dans la même conversation, on peut basculer d'un modèle local vers un modèle distant. C'est utile et c'est aussi le réglage à surveiller de près si l'objectif est que rien ne sorte : la possibilité technique existe, elle se désactive dans la configuration.
#À qui ça s'adresse
Ton ChatGPT privé et gratuit sur ta machine en 1 heure — LM Studio, Ollama, Open WebUI, tes documents, sans cloud.
- Espace en ligne à vie
- PDF + fichiers
- Remboursé 30 j
| Situation | Ce qui convient |
|---|---|
| Une personne, une machine, zéro administration | Une application de bureau tout-en-un |
| Une équipe, des comptes, un serveur partagé | LibreChat |
| Un poste unique avec une interface web légère | Open WebUI — voir le tutoriel dédié |
| Construire des applications avec API et journalisation | Une plateforme de création d'applications LLM |
La ligne de partage utile est le nombre d'utilisateurs. À partir du moment où plusieurs personnes doivent s'authentifier et retrouver leurs propres conversations, une application de bureau ne suffit plus, et LibreChat est bâti pour ce cas.
#L'installer avec Docker
- 01Récupérer le dépôt et le fichier d'environnement
- 02Générer les secrets
- 03Démarrer la pile
- 04Créer le premier compte, puis fermer les inscriptions
#Le brancher à Ollama
LibreChat déclare ses fournisseurs dans un fichier de configuration dédié, et traite Ollama comme un point d'accès compatible OpenAI. Deux pièges reviennent systématiquement.
- localhost désigne le conteneur
- Depuis l'intérieur de Docker, il faut l'adresse de l'hôte telle que la voit le conteneur, et Ollama doit écouter sur l'interface réseau et non seulement sur la boucle locale.
- La liste des modèles
- Selon la configuration, les modèles sont récupérés automatiquement auprès du serveur ou déclarés à la main. Une liste vide dans l'interface veut presque toujours dire que l'adresse de base est mauvaise, pas que le modèle manque.
Pour plusieurs personnes qui discutent en même temps, la question n'est plus l'interface mais le serveur d'inférence : un serveur pensé pour un utilisateur unique traite les requêtes les unes après les autres, et la troisième personne attend.
- Open WebUI : l'autre interface web de référence
- Servir plusieurs utilisateurs avec vLLM
- IA locale en entreprise : le cadre RGPD
#Discuter avec ses documents
LibreChat sait joindre des fichiers à une conversation et répondre à partir de leur contenu. Techniquement, c'est un service distinct de l'interface qui découpe les documents, les encode en vecteurs et les stocke ; il se déploie à côté et réclame un modèle d'embedding, qui n'est pas le modèle de conversation.
Deux constats valables pour tous les outils de cette famille : un PDF qui n'est qu'un scan ne contient aucun texte tant qu'il n'a pas été passé à la reconnaissance optique, et il s'indexe donc à vide ; et la pertinence dépend surtout du modèle d'embedding choisi, un point qui compte particulièrement pour des documents en français.
#Plusieurs utilisateurs : ce qu'il faut régler
- Inscription fermée
- Comptes créés par un administrateur, ou restriction à un domaine de courriel.
- Fournisseurs autorisés
- Si l'engagement est que rien ne sort, les fournisseurs distants se désactivent dans la configuration plutôt que dans les consignes d'usage.
- Quotas
- Un modèle local partagé n'a pas de facture, mais il a une file d'attente. Les limites par utilisateur protègent le confort de tous.
- Rétention
- Les conversations restent en base indéfiniment par défaut. Décidez d'une durée, écrivez-la, appliquez-la.
#Les limites
LibreChat est une application à administrer : mises à jour, sauvegardes, secrets, base de données. Ce n'est pas un exécutable qu'on double-clique, et l'effort n'a de sens qu'à partir de plusieurs utilisateurs. Certaines fonctions avancées demandent des services supplémentaires, donc davantage de mémoire sur une machine qui héberge déjà un modèle. Enfin, l'interface ne change rien à la qualité des réponses : un modèle de 8 milliards de paramètres répond comme un modèle de 8 milliards de paramètres, aussi soignée soit la fenêtre qui l'entoure.
#FAQ
LibreChat est-il gratuit ?+
Fonctionne-t-il entièrement hors ligne ?+
Pourquoi ma liste de modèles est-elle vide ?+
Combien d'utilisateurs peut-on servir ?+
Faut-il un GPU pour LibreChat ?+
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.