Ultima verifica:
Hermes Agent è stato rilasciato nel febbraio 2026 ed è a 237.000 stelle su GitHub ad agosto 2026. Gran parte dell’hype è giustificato, il ciclo che scrive skill riutilizzabili riduce davvero il costo dei task ricorrenti, ma i consigli di hosting che circolano ora sono terribili. La metà dei thread dice che un VPS da 5 dollari è sufficiente. L’altra metà consiglia di mettere un H100. Entrambe le affermazioni sono corrette per setup diversi, e la maggior parte delle persone sbaglia.
Ecco cosa ho realmente testato durante tre settimane di utilizzo di Hermes con gateway Telegram, Discord e Slack puntati su di esso.
Di cosa ha realmente bisogno Hermes da un VPS
Il processo dell’agente stesso è leggero. Python, uno store delle competenze SQLite, i daemon dei gateway, forse 300-500 MB di memoria residente in totale. La cosa che determina il costo è se hosti anche il modello sulla stessa macchina.
Due possibilità:
- Bring your own model. Hermes richiama un endpoint compatibile con OpenAI. Il VPS esegue solo l’orchestrazione. Puoi sopravvivere con 2 vCPU / 4 GB. Costo: 5-10 EUR al mese.
- Autohost il LLM anche. Ora hai bisogno almeno di 16 GB di RAM per un modello da 7B, 32 GB per 13B, e vuoi una GPU a meno che non ti piaccia avere risposte da 20 secondi. Costo: 100 EUR al mese o più.
La maggior parte delle persone inizia con il percorso 1 e passa al percorso 2 solo quando raggiunge limiti di utilizzo o desidera che le conversazioni siano completamente fuori dalle API esterne.
Confronto VPS per Hermes Agent
| Provider | Piani | vCPU | RAM | Disco | Mensile | Migliore per |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CX23 | 2 | 4 GB | 40 GB NVMe | 5,49 EUR netti | Modello BYO, la scelta predefinita |
| Contabo | Cloud VPS 4 | 4 | 8 GB | 100 GB SSD | 5,50 EUR netti | Modello BYO più servizi accessori |
| Hetzner Cloud | CX33 | 4 | 8 GB | 80 GB NVMe | 8,49 EUR netti | Margine in più, su NVMe |
| Hetzner Cloud | CCX13 | 2 | 8 GB | 80 GB NVMe | 42,99 EUR netti | vCPU dedicata, solo se serve |
| Hetzner GPU | GEX44 | 14 | 64 GB | 2x 1,92 TB | 234 EUR + 114 attiv. | Autohost modello 13B + agente |
Hetzner e Contabo indicano prezzi netti, quindi aggiungi la tua IVA.
Hetzner Cloud CX23: La scelta predefinita per setup con modello BYO
A 5,49 EUR netti per 2 vCPU e 4 GB, questa è la scelta predefinita onesta. Un Hermes in modalità bring-your-own-model occupa 300-500 MB, quindi il margine lo compri per i gateway e per quello che vive accanto, non per l’agente. La latenza verso OpenAI e Anthropic da Falkenstein è inferiore a 80 ms, il che avvantaggia il loop di Hermes quando concatena chiamate a strumenti.
Vantaggi che contano per Hermes:
- Il piano credibile più economico che lascia ancora spazio a un secondo servizio
- API + Terraform semplificano il redeploy dopo una skill scritta male
- Giurisdizione UE se i tuoi gateway trasportano dati personali
Passa al CX33 (4 vCPU / 8 GB, 8,49 EUR netti) se attivi anche la trascrizione dei messaggi vocali: tira dentro ffmpeg ed è l’unica funzione di Hermes davvero esigente in CPU.
Lascia perdere il CCX13 finché non sai esattamente perché lo vuoi. Costa 42,99 EUR netti per gli stessi 8 GB del CX33, e quello che paghi è la vCPU dedicata. Hermes passa il tempo in attesa di un endpoint remoto, quindi la vCPU condivisa non è il suo collo di bottiglia. I core dedicati valgono per l’inferenza locale o per un carico multi-tenant rumoroso, non per questo.
Prendi Hetzner qui: Hetzner Cloud.
Contabo Cloud VPS 4: Il miglior rapporto qualità-prezzo della tabella
A 5,50 EUR netti per 4 vCPU e 8 GB di RAM, nessuno batte Contabo sulle specifiche per euro: il doppio della RAM del CX23 per un centesimo in più. Lo storage è SSD anziché NVMe, cosa di cui a Hermes non importa, ma il provisioning richiede ore invece di secondi.
Quello che nessuno menziona: la rete in uscita di Contabo può rallentare nelle ore di punta quando chiama API di modelli esterne, aggiungendo 100-300 ms a ogni turno di Hermes. Fastidioso, ma non fatale.
Vantaggi:
- Più RAM per euro di qualsiasi altro piano qui
- 4 vCPU sono sovradimensionate per il solo agente ed esattamente giuste appena aggiungi la trascrizione vocale o un secondo servizio
Prendi Contabo: Contabo.
DigitalOcean: Per stack basati negli USA
Se endpoint del modello, workspace Slack e team sono tutti in US-east, la regione NYC3 di DigitalOcean vince sulla latenza. Il marketplace 1-click è irrilevante per Hermes perché non esiste un template, ma il sistema di snapshot è davvero utile per tornare indietro dopo una skill scritta male.
Lati negativi sinceri: DigitalOcean costa diverse volte quanto Hetzner o Contabo a parità di RAM, e nel 2026 ha ristrutturato la gamma di droplet. Controlla nomi di piano e prezzi attuali sulla loro pagina prezzi invece di fidarti di una tabella - comprese le versioni più vecchie di questa.
Configura DigitalOcean: DigitalOcean.
Hetzner GEX44: Se autohosti l’LLM
Quando vuoi Hermes più un modello da 13B in esecuzione sulla stessa macchina, serve GPU. Il GEX44 con RTX 4000 SFF Ada è l’opzione più economica in Europa a 234 EUR al mese più 114 EUR di attivazione. I suoi 20 GB di VRAM ospitano un 13B a 4 bit con spazio per l’agente accanto. Un Llama 3.1 70B a 4 bit richiede circa 40 GB e non ci sta: per quello serve il GEX131 da 96 GB a 1.199 EUR al mese.
Questo è troppo per il 90% degli utenti Hermes. Prendilo solo se hai un requisito di privacy che esclude chiamate API esterne.
Cosa sceglierei realmente
Se inizi oggi e vuoi solo far funzionare Hermes con la tua app di messaggistica preferita:
- Il più economico che funziona: Hetzner CX23, 5,49 EUR netti
- Miglior rapporto qualità-prezzo: Contabo Cloud VPS 4, 5,50 EUR netti per 8 GB
- Trascrizione vocale o un secondo servizio: Hetzner CX33, 8,49 EUR netti
- Team negli USA: DigitalOcean, prezzi attuali sul loro sito
- Privacy prima di tutto, autohost del modello: Hetzner GEX44
Per una panoramica completa di tutti gli strumenti autohosted, consulta il SelfHostVPS comparison. Il progetto Hermes Agent si muove rapidamente, quindi aggiorno questa pagina quando ci sono cambiamenti significativi nel ramo principale.
Frequently asked questions
Qual è la configurazione minima di VPS per eseguire Hermes Agent comodamente?
Se punti Hermes a un endpoint di modelli remoti (compatibile con OpenAI, Together, Anthropic), 2 vCPU e 4 GB di RAM sono il limite realistico. L'agente stesso, lo store delle competenze SQLite e i gateway di messaging non sono pesanti. Nel momento in cui autohosti il modello di inferenza sulla stessa macchina, sono necessari 16 GB di RAM e una GPU. Non tentare l'inferenza CPU per un agente di uso quotidiano, la latenza uccide il ciclo.
Hermes Agent ha bisogno di una GPU sul VPS?
Solo se esegui anche localmente il modello di linguaggio. Hermes stesso è uno strato di orchestrazione Python 3.11 più il ciclo che scrive le sue skill, che è limitato da I/O e token out dal modello, non dal calcolo locale. Un server Hetzner CCX o Contabo solo CPU va bene quando il modello risiede altrove. I server GPU Hetzner o Genesis Cloud sono le opzioni GPU più economiche in Europa.
Posso eseguire Hermes Agent su un VPS da 5 dollari come dicono i documenti?
Sì, ma solo nell'impostazione bring-your-own-model. I documenti ufficiali fanno riferimento a una fascia da 5 dollari perché Hermes streamma le completions da un endpoint remoto, quindi l'impronta dell'agente è piccola. Aggiungi un gateway Telegram e Slack e sei intorno ai 350 MB di RAM residenti. La fascia da 5 dollari fallisce nel momento in cui abiliti inferenza locale, trascrizione Whisper o strumenti di visione.
Hermes ha bisogno di NVMe o basta un SSD?
Basta un SSD. Dopo un task complesso Hermes scrive un file di skill e accoda a un indice SQLite FTS5: un pattern leggero e a raffiche, misurato in kilobyte, non il throughput sostenuto che serve a un server di database. Il Contabo Cloud VPS 4 monta SSD anziché NVMe ed esegue Hermes senza problemi. L'NVMe conviene quando autohosti anche il modello e carichi da disco pesi da diversi gigabyte, perché lì stai davvero pagando la velocità di lettura sequenziale.