Pruebas independientes Actualizado agosto 2026 387 guías de autoalojamiento 5 proveedores VPS probados

comparison

El mejor VPS para Letta (2026): hosting de agentes con memoria que aguanta

Los agentes con estado de Letta necesitan el VPS adecuado o las consultas de memoria se arrastran. Specs y precios reales, y qué plan barato se ahoga.

Última verificación:

Letta es el proyecto que antes se llamaba MemGPT, ahora renombrado y distribuido bajo un patrocinador comercial serio. Es el planteamiento open source más limpio de agentes con estado que he usado. La contrapartida es que el valor viene de la capa de memoria, y esa capa de memoria es una base de datos PostgreSQL más pgvector de verdad. Eso cambia qué tipo de VPS conviene comprar.

Para este artículo, hice funcionar Letta durante once semanas en dos servidores, comparando cómo aguantan las consultas de memoria a medida que crece el número de agentes.

Lo que Letta realmente necesita

El runtime del agente es ligero: FastAPI, un worker para el bucle de pasos del agente, una capa de websockets. Puede que 250 a 400 MB de RAM residente incluso con veinte agentes.

Lo que dispara el coste es la base de datos. Postgres más pgvector para la memoria vectorial, más almacenamiento de archivo para los bloques de pasajes a largo plazo. Con un uso intenso verás:

Por eso el I/O de disco importa más en Letta que en un agente sin estado.

Comparativa de VPS para Letta

ProveedorPlanvCPURAMDiscoMensualMejor para
Hetzner CloudCCX1328 GB80 GB NVMe42.99 EUROpción por defecto, usuario único o equipo pequeño
Contabo VPSVPS S48 GB100 GB NVMe4.50 EUROpción económica, acepta un aprovisionamiento más lento
DigitalOceanPremium AMD 2 GB24 GB80 GB NVMe21 USDEquipo en EE. UU., carga ligera
HetznerEX44 dedicated6 cores64 GB2x 512 GB NVMe51 EURProducción intensiva con muchos agentes

Hetzner Cloud CCX13: la opción por defecto

El NVMe y la vCPU dedicada hacen que las consultas de pgvector vayan rápidas. Con un centenar de agentes y unos miles de pasajes almacenados, el recall de memoria se mantiene por debajo de 200 ms en este nivel, que es lo que hace falta para que el bucle del agente se sienta ágil. La capa de memoria de archivo de Letta genera muchas inserciones pequeñas, y el I/O de Hetzner es lo bastante constante como para no notar la ralentización de última hora de la tarde que sufren algunas plataformas compartidas.

Ventajas que importan aquí:

La pega real: el nivel CCX más barato tope en 8 GB. En cuanto lo superas, saltas a CCX23 a casi el doble de precio.

Consigue Hetzner aquí: Hetzner Cloud.

Contabo VPS S: la opción económica

4 vCPU y 8 GB por 4.50 EUR es difícil de superar sobre el papel, y los planes NVMe más recientes aguantan bien con Letta mientras no superes unos cientos de agentes. La pega es el tiempo de aprovisionamiento, que se mide en horas y no en segundos. Si configuras el servidor una vez y lo dejas funcionando, no te va a importar.

El compromiso: la latencia de salida hacia los endpoints de OpenAI y Anthropic es sistemáticamente entre 100 y 200 ms peor que en Hetzner desde los centros de datos europeos de Contabo. Para Letta eso se traduce en pasos de agente más lentos cuando el modelo hace el trabajo pesado.

Consigue Contabo: Contabo VPS.

DigitalOcean Premium AMD 2 GB: configuración en la costa este de EE. UU.

Si tu equipo está en Norteamérica, los nodos Premium AMD de DigitalOcean en NYC3 ofrecen la latencia más baja hacia OpenAI y Anthropic entre los proveedores habituales. 4 GB de RAM bastan para un puñado de usuarios con pocos agentes. Más allá de eso, yo saltaría directamente al plan de 8 GB.

Punto negativo honesto: 21 USD por 4 GB es caro frente a Hetzner. Pagas por la región y por el sistema de snapshots.

Configura DigitalOcean: DigitalOcean.

Hetzner EX44 dedicado: cuando Letta pasa a producción

Cuando Letta se convierte en la columna vertebral de un producto, los niveles de nube compartida empiezan a quedarse pequeños. El EX44, con 6 núcleos y 64 GB de RAM, da el margen necesario para ajustar Postgres correctamente, mantener el índice vectorial en RAM y no preocuparte por vecinos ruidosos. El precio es lo bastante competitivo como para sorprenderme de que no más gente salte directamente a él.

Consigue un servidor dedicado de Hetzner: Hetzner Robot.

Consejos de dimensionamiento de Postgres para Letta

Tres cosas que me habría gustado saber antes:

  1. Ajusta shared_buffers al 25 por ciento de la RAM. El valor por defecto de 128 MB es incorrecto para cualquier carga de trabajo real. Letta exige mucho al buffer cache durante el recall de memoria.
  2. Mueve el WAL a un disco separado si puedes. En un servidor dedicado supone una gran mejora. En un VPS en la nube con un solo disco, sáltate este paso.
  3. Haz vacuum a menudo. Las inserciones de memoria de archivo y las actualizaciones de pasajes generan muchas tuplas muertas. Ajusta autovacuum_naptime a 30 segundos cuando el uso sea intenso.

Lo que yo elegiría en realidad

La mayoría de la gente quiere una de estas opciones:

Para ver el panorama completo, consulta la comparativa de SelfHostVPS. Letta avanza rápido y actualizo esta página cuando el esquema de la base de datos o la capa de almacenamiento cambian de forma significativa.

Frequently asked questions

¿Cuál es la especificación mínima de VPS para autoalojar Letta?

2 vCPU y 4 GB de RAM son el mínimo si Letta apunta a una API de modelo remota. El grueso del consumo lo forman la base de datos PostgreSQL más pgvector, el servidor FastAPI y el runtime del agente. Con diez o veinte agentes activos se mantiene cómodamente por debajo de 2 GB residentes. En cuanto empieces a almacenar decenas de miles de pasajes de memoria, conviene pasar a 8 GB para que el índice vectorial viva en RAM.

¿Necesita Letta su propio servidor PostgreSQL?

Letta incluye un modo SQLite embebido para pruebas y un modo PostgreSQL más pgvector para cualquier uso real. Para autoalojarlo conviene el modo Postgres, ya sea en el mismo VPS o en una base de datos gestionada. SQLite funciona bien el primer fin de semana, pero es un desastre al tercer mes.

¿Se puede ejecutar Letta en un VPS de Contabo de 5 dólares?

Sí, para un solo usuario con un puñado de agentes. El servidor de Letta en sí es ligero. El punto de quiebre llega cuando hay muchos agentes con bloques de memoria grandes. A esa escala, la búsqueda de similitud de pgvector se convierte en el cuello de botella y empiezas a necesitar discos más rápidos y más RAM.

¿Hace falta una GPU en el VPS para Letta?

Solo si autoalojas el modelo de lenguaje. Letta es puramente una capa de orquestación y almacenamiento, sin inferencia local. Un servidor solo con CPU, como un Hetzner CCX o una máquina Contabo NVMe, es la configuración habitual, con la clave de la API del modelo apuntando a OpenAI, Anthropic o tu propio servidor vLLM en otro lugar.