Última verificación:
LibreChat se ha convertido en la alternativa autoalojada a ChatGPT de facto para equipos en 2026. Es compatible con los grandes proveedores, MCP, Agents, Artifacts, Code Interpreter y autenticación multiusuario. Esa densidad de funciones también implica una curva de recursos más amplia que la de una interfaz de chat sencilla como Open WebUI.
Yo llevo una instancia de LibreChat para un equipo de cinco personas en Hetzner y he probado cuatro niveles de VPS distintos para entender dónde están realmente los límites.
Lo que realmente necesita LibreChat
Cuatro consumidores de recursos que hay que dimensionar:
- El servidor de la API. Node, el runtime de agentes, la capa MCP. De 300 a 500 MB de memoria residente en reposo.
- MongoDB. El factor más grande. Conversaciones, definiciones de agentes, metadatos de archivos, todo en Mongo. Planifica 1 GB más el crecimiento.
- Meilisearch. El índice de búsqueda de texto. Aproximadamente del tamaño de tu corpus de mensajes. Quiere quedarse en memoria.
- Code Interpreter. Opcional pero pesado cuando está activado. Cada ejecución lanza un contenedor en sandbox.
Lo que sorprende a la gente: el servicio RAG-API es un proceso separado con su propia caché de embeddings. La configuración por defecto carga un modelo sentence transformer y lo ejecuta en CPU. Planifica otro 1 GB de memoria residente y una primera solicitud lenta.
Comparativa de VPS para LibreChat
| Proveedor | Plan | vCPU | RAM | Disco | Mensual | Ideal para |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CCX13 | 2 | 8 GB | 80 GB NVMe | 42.99 EUR | Individual a equipo pequeño, elección por defecto |
| Contabo VPS | VPS S | 4 | 8 GB | 100 GB NVMe | 4.50 EUR | Económico, uso individual o en pareja |
| DigitalOcean | Premium AMD 4 GB | 2 | 8 GB | 100 GB NVMe | 28 USD | Equipo en EE. UU., carga baja |
| Hetzner Cloud | CCX23 | 4 | 16 GB | 160 GB NVMe | 85.99 EUR | Equipo más grande con Code Interpreter |
Hetzner Cloud CCX13: la opción por defecto
Es donde yo tengo la mía. La combinación de Mongo y Meilisearch se comporta bien en el NVMe de Hetzner, y la latencia desde Falkenstein hasta Anthropic y OpenAI está por debajo de 80 ms, lo que hace que el bucle del agente se sienta ágil. 8 GB de RAM bastan para un equipo pequeño con búsqueda de archivos y MCP activados.
Ventajas importantes:
- El NVMe soporta bien el patrón de escritura de Mongo
- Los snapshots facilitan revertir una mala actualización de LibreChat
- API más Terraform si quieres infraestructura como código
Desventaja real: el techo de 8 GB del CCX13. En cuanto añades Code Interpreter con varios usuarios simultáneos, te quedas corto y pasas al CCX23.
Consigue Hetzner: Hetzner Cloud.
Contabo VPS S: la opción económica
4 vCPU y 8 GB por 4.50 EUR. Los planes NVMe más recientes de Contabo aguantan bien para LibreChat siempre que no actives todos los servicios opcionales. Las contrapartidas son las de siempre:
- Aprovisionamiento lento, horas y no segundos
- Mayor latencia de salida hacia las API de modelos desde los nodos europeos de Contabo
- Los tiempos de respuesta del soporte pueden alargarse en los niveles más baratos
Para uso personal o entre dos personas, es difícil discutir este precio.
Consigue Contabo: Contabo VPS.
DigitalOcean Premium AMD 4 GB: para equipos en la costa este de EE. UU.
El plan Premium AMD de 8 GB basta para un equipo pequeño en EE. UU. con un uso ligero de agentes. NYC3 es el camino más barato hacia baja latencia en las llamadas al modelo si tu equipo está en la costa este. Los snapshots son útiles cuando LibreChat lanza cambios incompatibles.
Desventaja honesta: 28 USD al mes por 8 GB es caro frente a Hetzner. Pagas por la región y por el sistema de snapshots.
Consigue DigitalOcean: DigitalOcean.
Hetzner Cloud CCX23: para equipos reales
En cuanto activas Code Interpreter y tienes a varios usuarios ejecutando agentes al mismo tiempo, el nivel de 8 GB se queda justo. El CCX23, con 16 GB de RAM y 4 vCPU dedicadas, te da margen para ejecuciones de agentes concurrentes sin ralentizar la experiencia de chat.
Consigue Hetzner: Hetzner Cloud.
Errores habituales en la configuración
Tres cosas que hay que prever:
- MongoDB necesita un volumen persistente real. No lo pongas en almacenamiento efímero. Perder la base de datos significa perder cada conversación y cada definición de agente.
- Meilisearch quiere mantenerse activo. Reinicia el servidor y las primeras búsquedas serán lentas. O lo precalientas o aceptas que las consultas de la mañana tarden un poco más.
- Los servidores MCP añaden latencia. Cada herramienta MCP a la que el agente tiene acceso se consulta durante la planificación. Recorta lo que cada usuario puede alcanzar para no pagar por herramientas que no usas.
Lo que elegiría de verdad
Si empiezas hoy:
- UE, uso diario por defecto: Hetzner CCX13
- UE, individual o en pareja, gasto mínimo: Contabo VPS S
- Equipo en la costa este de EE. UU.: DigitalOcean Premium AMD 8 GB
- Equipo con Code Interpreter: Hetzner CCX23
Para el panorama más amplio de la IA autoalojada, consulta la comparativa de SelfHostVPS. LibreChat lanza versiones cada mes, así que actualizo esta página cuando cambian los patrones importantes de recursos.
Frequently asked questions
¿Cuál es el VPS mínimo para LibreChat?
2 vCPU y 4 GB de RAM si mantienes el stack reducido (API de Node, MongoDB, Meilisearch, RAG-API) y sirves a menos de cinco usuarios. La mayor parte de la RAM va a MongoDB y al índice de Meilisearch, mientras que la API de Node se mantiene por debajo de 400 MB de memoria residente. Si añades Code Interpreter, la curva de recursos salta a 8 GB.
¿Necesita LibreChat una GPU?
No, a menos que también alojes tú mismo el modelo y Code Interpreter esté haciendo trabajo pesado de ML. El stack por defecto depende de la CPU, y toda la inferencia del modelo ocurre en el proveedor que conectes. Un servidor solo con CPU, ya sea Hetzner CCX o Contabo NVMe, es la configuración habitual.
¿Puedo ejecutar LibreChat en un servidor Contabo de 5 dólares?
Sí, para un solo usuario con tres o cuatro conversaciones al día. El límite llega cuando activas los servidores MCP, Code Interpreter o el pipeline RAG de búsqueda de archivos. En ese punto necesitas al menos 8 GB de RAM, o las llamadas del agente empiezan a tardar varios segundos visibles.
¿Cuánto disco debo planificar para LibreChat?
Planifica al menos 80 GB NVMe. MongoDB crece con cada conversación, la función de subida de archivos guarda los recursos en disco, y el índice de Meilisearch duplica tu almacenamiento de texto. Tras tres meses con un equipo pequeño he visto el volumen de datos superar los 22 GB.