Test indipendenti Aggiornato agosto 2026 387 guide di self-hosting 5 provider VPS testati

comparison

Miglior VPS per Hermes Agent (2026): Scelte di RAM reale + GPU

Autohosting dell'Hermes Agent di Nous Research? Ecco cosa si adatta davvero al carico di lavoro, più il VPS economico che si bloccherà con esso.

Ultima verifica:

Hermes Agent è stato rilasciato nel febbraio 2026 ed è a 237.000 stelle su GitHub ad agosto 2026. Gran parte dell’hype è giustificato, il ciclo che scrive skill riutilizzabili riduce davvero il costo dei task ricorrenti, ma i consigli di hosting che circolano ora sono terribili. La metà dei thread dice che un VPS da 5 dollari è sufficiente. L’altra metà consiglia di mettere un H100. Entrambe le affermazioni sono corrette per setup diversi, e la maggior parte delle persone sbaglia.

Ecco cosa ho realmente testato durante tre settimane di utilizzo di Hermes con gateway Telegram, Discord e Slack puntati su di esso.

Di cosa ha realmente bisogno Hermes da un VPS

Il processo dell’agente stesso è leggero. Python, uno store delle competenze SQLite, i daemon dei gateway, forse 300-500 MB di memoria residente in totale. La cosa che determina il costo è se hosti anche il modello sulla stessa macchina.

Due possibilità:

  1. Bring your own model. Hermes richiama un endpoint compatibile con OpenAI. Il VPS esegue solo l’orchestrazione. Puoi sopravvivere con 2 vCPU / 4 GB. Costo: 5-10 EUR al mese.
  2. Autohost il LLM anche. Ora hai bisogno almeno di 16 GB di RAM per un modello da 7B, 32 GB per 13B, e vuoi una GPU a meno che non ti piaccia avere risposte da 20 secondi. Costo: 100 EUR al mese o più.

La maggior parte delle persone inizia con il percorso 1 e passa al percorso 2 solo quando raggiunge limiti di utilizzo o desidera che le conversazioni siano completamente fuori dalle API esterne.

Confronto VPS per Hermes Agent

ProviderPianivCPURAMDiscoMensileMigliore per
Hetzner CloudCX2324 GB40 GB NVMe5,49 EUR nettiModello BYO, la scelta predefinita
ContaboCloud VPS 448 GB100 GB SSD5,50 EUR nettiModello BYO più servizi accessori
Hetzner CloudCX3348 GB80 GB NVMe8,49 EUR nettiMargine in più, su NVMe
Hetzner CloudCCX1328 GB80 GB NVMe42,99 EUR nettivCPU dedicata, solo se serve
Hetzner GPUGEX441464 GB2x 1,92 TB234 EUR + 114 attiv.Autohost modello 13B + agente

Hetzner e Contabo indicano prezzi netti, quindi aggiungi la tua IVA.

Hetzner Cloud CX23: La scelta predefinita per setup con modello BYO

A 5,49 EUR netti per 2 vCPU e 4 GB, questa è la scelta predefinita onesta. Un Hermes in modalità bring-your-own-model occupa 300-500 MB, quindi il margine lo compri per i gateway e per quello che vive accanto, non per l’agente. La latenza verso OpenAI e Anthropic da Falkenstein è inferiore a 80 ms, il che avvantaggia il loop di Hermes quando concatena chiamate a strumenti.

Vantaggi che contano per Hermes:

Passa al CX33 (4 vCPU / 8 GB, 8,49 EUR netti) se attivi anche la trascrizione dei messaggi vocali: tira dentro ffmpeg ed è l’unica funzione di Hermes davvero esigente in CPU.

Lascia perdere il CCX13 finché non sai esattamente perché lo vuoi. Costa 42,99 EUR netti per gli stessi 8 GB del CX33, e quello che paghi è la vCPU dedicata. Hermes passa il tempo in attesa di un endpoint remoto, quindi la vCPU condivisa non è il suo collo di bottiglia. I core dedicati valgono per l’inferenza locale o per un carico multi-tenant rumoroso, non per questo.

Prendi Hetzner qui: Hetzner Cloud.

Contabo Cloud VPS 4: Il miglior rapporto qualità-prezzo della tabella

A 5,50 EUR netti per 4 vCPU e 8 GB di RAM, nessuno batte Contabo sulle specifiche per euro: il doppio della RAM del CX23 per un centesimo in più. Lo storage è SSD anziché NVMe, cosa di cui a Hermes non importa, ma il provisioning richiede ore invece di secondi.

Quello che nessuno menziona: la rete in uscita di Contabo può rallentare nelle ore di punta quando chiama API di modelli esterne, aggiungendo 100-300 ms a ogni turno di Hermes. Fastidioso, ma non fatale.

Vantaggi:

Prendi Contabo: Contabo.

DigitalOcean: Per stack basati negli USA

Se endpoint del modello, workspace Slack e team sono tutti in US-east, la regione NYC3 di DigitalOcean vince sulla latenza. Il marketplace 1-click è irrilevante per Hermes perché non esiste un template, ma il sistema di snapshot è davvero utile per tornare indietro dopo una skill scritta male.

Lati negativi sinceri: DigitalOcean costa diverse volte quanto Hetzner o Contabo a parità di RAM, e nel 2026 ha ristrutturato la gamma di droplet. Controlla nomi di piano e prezzi attuali sulla loro pagina prezzi invece di fidarti di una tabella - comprese le versioni più vecchie di questa.

Configura DigitalOcean: DigitalOcean.

Hetzner GEX44: Se autohosti l’LLM

Quando vuoi Hermes più un modello da 13B in esecuzione sulla stessa macchina, serve GPU. Il GEX44 con RTX 4000 SFF Ada è l’opzione più economica in Europa a 234 EUR al mese più 114 EUR di attivazione. I suoi 20 GB di VRAM ospitano un 13B a 4 bit con spazio per l’agente accanto. Un Llama 3.1 70B a 4 bit richiede circa 40 GB e non ci sta: per quello serve il GEX131 da 96 GB a 1.199 EUR al mese.

Questo è troppo per il 90% degli utenti Hermes. Prendilo solo se hai un requisito di privacy che esclude chiamate API esterne.

Cosa sceglierei realmente

Se inizi oggi e vuoi solo far funzionare Hermes con la tua app di messaggistica preferita:

Per una panoramica completa di tutti gli strumenti autohosted, consulta il SelfHostVPS comparison. Il progetto Hermes Agent si muove rapidamente, quindi aggiorno questa pagina quando ci sono cambiamenti significativi nel ramo principale.

Frequently asked questions

Qual è la configurazione minima di VPS per eseguire Hermes Agent comodamente?

Se punti Hermes a un endpoint di modelli remoti (compatibile con OpenAI, Together, Anthropic), 2 vCPU e 4 GB di RAM sono il limite realistico. L'agente stesso, lo store delle competenze SQLite e i gateway di messaging non sono pesanti. Nel momento in cui autohosti il modello di inferenza sulla stessa macchina, sono necessari 16 GB di RAM e una GPU. Non tentare l'inferenza CPU per un agente di uso quotidiano, la latenza uccide il ciclo.

Hermes Agent ha bisogno di una GPU sul VPS?

Solo se esegui anche localmente il modello di linguaggio. Hermes stesso è uno strato di orchestrazione Python 3.11 più il ciclo che scrive le sue skill, che è limitato da I/O e token out dal modello, non dal calcolo locale. Un server Hetzner CCX o Contabo solo CPU va bene quando il modello risiede altrove. I server GPU Hetzner o Genesis Cloud sono le opzioni GPU più economiche in Europa.

Posso eseguire Hermes Agent su un VPS da 5 dollari come dicono i documenti?

Sì, ma solo nell'impostazione bring-your-own-model. I documenti ufficiali fanno riferimento a una fascia da 5 dollari perché Hermes streamma le completions da un endpoint remoto, quindi l'impronta dell'agente è piccola. Aggiungi un gateway Telegram e Slack e sei intorno ai 350 MB di RAM residenti. La fascia da 5 dollari fallisce nel momento in cui abiliti inferenza locale, trascrizione Whisper o strumenti di visione.

Hermes ha bisogno di NVMe o basta un SSD?

Basta un SSD. Dopo un task complesso Hermes scrive un file di skill e accoda a un indice SQLite FTS5: un pattern leggero e a raffiche, misurato in kilobyte, non il throughput sostenuto che serve a un server di database. Il Contabo Cloud VPS 4 monta SSD anziché NVMe ed esegue Hermes senza problemi. L'NVMe conviene quando autohosti anche il modello e carichi da disco pesi da diversi gigabyte, perché lì stai davvero pagando la velocità di lettura sequenziale.