Dernière vérification:
LibreChat s’est imposé en 2026 comme l’alternative à ChatGPT auto-hébergée de référence pour les équipes. Il prend en charge les grands fournisseurs, MCP, les Agents, les Artifacts, Code Interpreter et l’authentification multi-utilisateur. Cette densité de fonctionnalités signifie aussi une courbe de ressources plus large qu’une simple interface de chat comme Open WebUI.
Je fais tourner une instance LibreChat pour une équipe de cinq personnes chez Hetzner, et j’ai testé quatre niveaux de VPS différents pour comprendre où se situent réellement les points de rupture.
Ce dont LibreChat a vraiment besoin
Quatre postes de consommation de ressources à dimensionner :
- Le serveur API. Node, le runtime des agents, la couche MCP. 300 à 500 Mo de mémoire résidente au repos.
- MongoDB. Le principal facteur. Conversations, définitions d’agents, métadonnées de fichiers, tout passe par Mongo. Prévoyez 1 Go plus la croissance.
- Meilisearch. L’index de recherche texte. À peu près la taille de votre corpus de messages. Doit rester en mémoire.
- Code Interpreter. Optionnel mais lourd une fois activé. Chaque exécution lance un conteneur en bac à sable.
Ce qui surprend souvent : le service RAG-API est un processus séparé avec son propre cache d’embeddings. La configuration par défaut charge un modèle sentence transformer et l’exécute sur CPU. Prévoyez encore 1 Go de mémoire résidente et une première requête lente.
Comparatif VPS pour LibreChat
| Fournisseur | Offre | vCPU | RAM | Disque | Mensuel | Idéal pour |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CCX13 | 2 | 8 GB | 80 GB NVMe | 42,99 EUR | Solo à petite équipe, choix par défaut |
| Contabo VPS | VPS S | 4 | 8 GB | 100 GB NVMe | 4,50 EUR | Budget, usage solo ou à deux |
| DigitalOcean | Premium AMD 4 GB | 2 | 8 GB | 100 GB NVMe | 28 USD | Équipe US, faible charge |
| Hetzner Cloud | CCX23 | 4 | 16 GB | 160 GB NVMe | 85,99 EUR | Équipe plus grande avec Code Interpreter |
Hetzner Cloud CCX13 : le choix par défaut
C’est sur ce plan que je fais tourner la mienne. La combinaison Mongo et Meilisearch se comporte bien sur le NVMe de Hetzner, et la latence depuis Falkenstein vers Anthropic et OpenAI reste sous 80 ms, ce qui rend la boucle d’agent réactive. 8 Go de RAM suffisent pour une petite équipe avec recherche de fichiers et MCP activés.
Avantages à retenir :
- Le NVMe encaisse bien le pattern d’écriture de Mongo
- Les snapshots facilitent le retour en arrière après une mauvaise mise à jour de LibreChat
- API plus Terraform si vous voulez de l’infrastructure as code
Vrai inconvénient : le plafond de 8 Go du CCX13. Dès que vous ajoutez Code Interpreter avec plusieurs utilisateurs simultanés, vous le dépassez et passez au CCX23.
Prendre Hetzner : Hetzner Cloud.
Contabo VPS S : le choix économique
4 vCPU et 8 Go pour 4,50 EUR. Les nouvelles offres NVMe de Contabo tiennent bien la route pour LibreChat tant que vous n’activez pas tous les services optionnels. Les compromis sont familiers :
- Provisionnement lent, des heures et non des secondes
- Latence sortante plus élevée vers les API de modèles depuis les nœuds Contabo européens
- Les délais de réponse du support peuvent s’allonger sur les offres les moins chères
Pour un usage personnel ou à deux, difficile de contester ce prix.
Prendre Contabo : Contabo VPS.
DigitalOcean Premium AMD 4 Go : pour les équipes de la côte est américaine
L’offre Premium AMD à 8 Go suffit pour une petite équipe américaine avec un usage léger des agents. NYC3 est le chemin le moins cher vers une faible latence sur les appels de modèle si votre équipe est sur la côte est. Les snapshots sont utiles quand LibreChat déploie des changements cassants.
Point négatif honnête : 28 USD par mois pour 8 Go, c’est cher face à Hetzner. Vous payez pour la région et le système de snapshots.
Prendre DigitalOcean : DigitalOcean.
Hetzner Cloud CCX23 : pour les vraies équipes
Dès que vous activez Code Interpreter et que plusieurs utilisateurs font tourner des agents en même temps, le palier 8 Go devient juste. Le CCX23 avec 16 Go de RAM et 4 vCPU dédiés vous donne de la marge pour des exécutions d’agents concurrentes sans ralentir l’expérience de chat.
Prendre Hetzner : Hetzner Cloud.
Les pièges classiques de la configuration
Trois points à anticiper :
- MongoDB a besoin d’un vrai volume persistant. Ne le placez pas sur du stockage éphémère. Perdre la base de données, c’est perdre chaque conversation et chaque définition d’agent.
- Meilisearch veut rester chaud. Redémarrez le serveur et les premières recherches seront lentes. Soit vous préchauffez, soit vous acceptez que les requêtes du matin prennent un instant de plus.
- Les serveurs MCP ajoutent de la latence. Chaque outil MCP auquel l’agent a accès est interrogé pendant la planification. Réduisez ce que chaque utilisateur peut atteindre pour ne pas payer des outils que vous n’utilisez pas.
Ce que je choisirais vraiment
Si vous démarrez aujourd’hui :
- UE, usage quotidien par défaut : Hetzner CCX13
- UE, solo ou à deux, dépense minimale : Contabo VPS S
- Équipe côte est américaine : DigitalOcean Premium AMD 8 GB
- Équipe avec Code Interpreter : Hetzner CCX23
Pour une vue d’ensemble de l’IA auto-hébergée, voir le comparatif SelfHostVPS. LibreChat sort des versions tous les mois, donc je mets cette page à jour dès que les grands schémas de ressources changent.
Frequently asked questions
Quel est le VPS minimum pour LibreChat ?
2 vCPU et 4 Go de RAM suffisent si vous gardez une stack réduite (API Node, MongoDB, Meilisearch, RAG-API) et servez moins de cinq utilisateurs. L'essentiel de la RAM part dans MongoDB et l'index Meilisearch, l'API Node elle-même restant sous 400 Mo de mémoire résidente. Ajoutez Code Interpreter et la courbe de ressources grimpe à 8 Go.
LibreChat a-t-il besoin d'un GPU ?
Non, sauf si vous hébergez aussi le modèle vous-même et que Code Interpreter effectue des tâches de machine learning lourdes. La stack par défaut est limitée par le CPU, toute l'inférence du modèle se faisant chez le fournisseur que vous branchez. Un VPS Hetzner CCX ou Contabo NVMe sans GPU est le montage habituel.
Puis-je faire tourner LibreChat sur un serveur Contabo à 5 dollars ?
Oui, pour un utilisateur seul avec trois ou quatre conversations par jour. Le point de rupture survient quand vous activez les serveurs MCP, Code Interpreter ou le pipeline de recherche documentaire RAG. À partir de là, il vous faut au moins 8 Go de RAM, sinon les appels d'agents commencent à prendre plusieurs secondes visibles.
Quel espace disque prévoir pour LibreChat ?
Prévoyez au moins 80 Go de NVMe. MongoDB grossit à chaque conversation, la fonction d'upload de fichiers stocke des ressources sur le disque, et l'index Meilisearch double votre volume de stockage texte. Après trois mois avec une petite équipe, j'ai vu le volume de données dépasser 22 Go.