Última verificación:
Hermes Agent se lanzó en febrero de 2026 y está en 237K estrellas de GitHub a agosto de 2026. La mayor parte del hype es justo, el bucle que escribe sus propias habilidades sí reduce el coste de las tareas repetidas, pero el consejo de hosting que circula ahora mismo es terrible. La mitad de los hilos dicen que un VPS de 5 dólares basta. La otra mitad recomienda poner un H100. Ambos casos son correctos para diferentes configuraciones, y la mayoría elige mal.
Aquí está lo que realmente he probado durante tres semanas ejecutando Hermes con puertas de Telegram, Discord y Slack apuntadas a él.
Lo que Hermes realmente necesita de un VPS
El proceso del agente en sí es liviano. Python, una tienda de habilidades SQLite, los daemons de las puertas de enlace, tal vez entre 300 y 500 MB de memoria residente en total. Lo que decide tu factura es si también alojas el modelo en la misma máquina.
Dos caminos:
- Trae tu propio modelo. Hermes llama a un endpoint compatible con OpenAI. El VPS solo ejecuta la orquestación. Puedes sobrevivir con 2 vCPU / 4 GB. Costo: 5 a 10 EUR al mes.
- Auto-alojar también el LLM. Ahora necesitas un mínimo de 16 GB de RAM para un modelo de 7B, 32 GB para 13B, y quieres una GPU a menos que disfrutes de respuestas de 20 segundos. Costo: 100 EUR al mes o más.
La mayoría comienza con el camino 1 y solo pasa al camino 2 cuando alcanza límites de uso o cuando quiere que sus conversaciones estén completamente fuera de APIs externas.
Comparación de VPS para Hermes Agent
| Proveedor | Plan | vCPU | RAM | Disco | Mensual | Mejor opción |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CX23 | 2 | 4 GB | 40 GB NVMe | 5,49 EUR sin IVA | Modelo BYO, la opción por defecto |
| Contabo | Cloud VPS 4 | 4 | 8 GB | 100 GB SSD | 5,50 EUR sin IVA | Modelo BYO más servicios auxiliares |
| Hetzner Cloud | CX33 | 4 | 8 GB | 80 GB NVMe | 8,49 EUR sin IVA | Margen de sobra, sobre NVMe |
| Hetzner Cloud | CCX13 | 2 | 8 GB | 80 GB NVMe | 42,99 EUR sin IVA | vCPU dedicada, solo si la necesitas |
| Hetzner GPU | GEX44 | 14 | 64 GB | 2x 1,92 TB | 234 EUR + 114 alta | Autoalojar modelo 13B + agente |
Hetzner y Contabo indican precios sin IVA, así que suma el tuyo.
Hetzner Cloud CX23: La opción por defecto para configuraciones BYO-modelo
Por 5,49 EUR sin IVA con 2 vCPU y 4 GB, esta es la opción por defecto honesta. Un Hermes en modo bring-your-own-model ocupa de 300 a 500 MB, así que el margen lo compras para los gateways y para lo demás que viva en la máquina, no para el agente. La latencia hacia OpenAI y Anthropic desde Falkenstein es inferior a 80 ms, lo cual beneficia al ciclo de Hermes cuando encadena llamadas a herramientas.
Ventajas que importan para Hermes:
- El plan creíble más barato que aún deja sitio para un segundo servicio
- API + Terraform simplifican el redespliegue tras una habilidad mal escrita
- Jurisdicción de la UE si tus gateways de mensajería manejan datos personales
Sube al CX33 (4 vCPU / 8 GB, 8,49 EUR sin IVA) si además activas la transcripción de notas de voz: arrastra ffmpeg y es la única función de Hermes realmente exigente con la CPU.
Evita el CCX13 salvo que sepas exactamente por qué lo quieres. Cuesta 42,99 EUR sin IVA por los mismos 8 GB que el CX33, y lo que pagas es la vCPU dedicada. Hermes se pasa el tiempo esperando a un endpoint de modelo remoto, así que la vCPU compartida no es su cuello de botella. Los núcleos dedicados valen la pena para inferencia local o una carga multi-inquilino ruidosa, no para esto.
Consigue Hetzner aquí: Hetzner Cloud.
Contabo Cloud VPS 4: La mejor relación calidad-precio de la tabla
Por 5,50 EUR sin IVA con 4 vCPU y 8 GB de RAM, nadie gana a Contabo en specs por euro: el doble de RAM que el CX23 por un céntimo más. El almacenamiento es SSD en lugar de NVMe, algo que a Hermes le da igual, pero el aprovisionamiento tarda horas en vez de segundos.
Lo que nadie menciona: la salida de red de Contabo puede ir lenta en horas punta al llamar a APIs de modelos externas, lo que añade de 100 a 300 ms a cada turno de Hermes. Molesto, pero no fatal.
Ventajas:
- La mayor cantidad de RAM por euro de todos los planes aquí
- 4 vCPU sobran para el agente por sí solo y son justo lo necesario en cuanto añades transcripción de voz o un segundo servicio
Consigue Contabo: Contabo.
DigitalOcean: Para stacks en EE.UU.
Si tu endpoint de modelo, tu espacio de Slack y tu equipo están todos en US-east, la región NYC3 de DigitalOcean gana en latencia. El marketplace de 1 clic es irrelevante para Hermes porque no hay plantilla, pero el sistema de snapshots sí resulta útil para revertir una habilidad mal escrita.
Inconvenientes honestos: DigitalOcean cuesta varias veces lo que Hetzner o Contabo por la misma RAM, y reestructuró su gama de droplets en 2026. Consulta los nombres de plan y precios actuales en su página de precios en lugar de fiarte de una tabla - incluidas versiones antiguas de esta.
Configura DigitalOcean: DigitalOcean.
Hetzner GEX44: Si auto-alojas el LLM
En el momento en que quieres Hermes junto a un modelo 13B en la misma máquina, necesitas GPU. El GEX44 con una RTX 4000 SFF Ada es la opción más asequible en Europa a 234 EUR al mes más 114 EUR de alta. Sus 20 GB de VRAM alojan un 13B en 4 bits con sitio para el agente al lado. Un Llama 3.1 70B en 4 bits necesita unos 40 GB y no cabe: para eso está el GEX131 de 96 GB a 1.199 EUR al mes.
Esto es excesivo para el 90% de los usuarios de Hermes. Solo elige esto si tienes un mandato de privacidad que descarta llamadas API externas.
Lo que realmente elegiría
Si comienzas hoy y solo quieres que Hermes funcione con tu app de mensajería favorita:
- Lo más barato que funciona: Hetzner CX23, 5,49 EUR sin IVA
- Mejor relación calidad-precio: Contabo Cloud VPS 4, 5,50 EUR sin IVA por 8 GB
- Transcripción de voz o un segundo servicio: Hetzner CX33, 8,49 EUR sin IVA
- Equipo en EE.UU.: DigitalOcean, precios actuales en su web
- Privacidad prioritaria, autoalojar el modelo: Hetzner GEX44
Para una vista completa de todas las herramientas autoalojadas, consulta la comparación SelfHostVPS. El proyecto Hermes Agent avanza rápido, así que actualizo esta página cuando cambios significativos llegan a la rama principal.
Frequently asked questions
¿Cuál es la especificación mínima de VPS para ejecutar Hermes Agent cómodamente?
Si apuntas Hermes a un endpoint de modelo remoto (compatible con OpenAI, Together, Anthropic), 2 vCPU y 4 GB de RAM es la base realista. El propio agente, la tienda de habilidades SQLite y las puertas de enlace de mensajería no son pesados. En el momento en que alojas localmente el modelo de inferencia en la misma máquina, necesitas 16 GB de RAM y una GPU. No intentes inferencia por CPU para un agente de uso diario, la latencia arruina el ciclo.
¿Necesita Hermes Agent una GPU en el VPS?
Solo si también ejecutas el modelo de lenguaje localmente. Hermes en sí es una capa de orquestación en Python 3.11 más el bucle que escribe sus habilidades, que está limitado por I/O y tokens generados por el modelo, no por el computo local. Una caja Hetzner CCX o Contabo solo con CPU está bien cuando el modelo reside en otro lugar. Los servidores GPU de Hetzner o Genesis Cloud son las opciones más económicas con GPU en Europa.
¿Puedo ejecutar Hermes Agent en un VPS de 5 dólares como afirman los docs?
Sí, pero solo en la configuración de traer tu propio modelo. Los docs oficiales mencionan un nivel de 5 dólares porque Hermes transmite las completions desde un endpoint remoto, por lo que la huella del agente es pequeña. Agrega una puerta de enlace para Telegram y Slack y estarás usando alrededor de 350 MB de RAM en residente. El nivel de 5 dólares se rompe en cuanto habilitas inferencia local, transcripción con Whisper o herramientas de visión.
¿Hermes necesita NVMe o basta con SSD?
Basta con SSD. Tras una tarea compleja Hermes escribe un archivo de habilidad y añade a un índice SQLite FTS5: un patrón ligero y a ráfagas que se mide en kilobytes, no el rendimiento sostenido que necesita un servidor de base de datos. El Contabo Cloud VPS 4 viene con SSD y ejecuta Hermes sin problemas. El NVMe compensa cuando además autoalojas el modelo y cargas varios gigabytes de pesos desde disco, porque ahí sí pagas por la velocidad de lectura secuencial.