Zuletzt geprüft:
Hermes Agent wurde im Februar 2026 veröffentlicht und steht im August 2026 bei 237.000 GitHub-Sternen. Der größte Teil des Hypes ist gerechtfertigt, die Schleife, die eigene Skills schreibt, senkt die Kosten wiederkehrender Aufgaben tatsächlich, aber die Hosting-Tipps, die momentan kursieren, sind schlecht. Die Hälfte der Threads behauptet, ein 5-Dollar-VPS reiche aus. Die andere Hälfte empfiehlt eine H100. Beide sind für unterschiedliche Setups richtig, aber die meisten Menschen treffen falsche Entscheidungen.
Hier ist, was ich tatsächlich über drei Wochen getestet habe, in denen Hermes mit Telegram-, Discord- und Slack-Gateways betrieben wurde.
Was Hermes wirklich von einem VPS braucht
Der Agent-Prozess selbst ist leicht. Python, ein SQLite Skill-Store, die Gateway-Daemons, vielleicht insgesamt 300 bis 500 MB RAM. Das, was deine Rechnung beeinflusst, ist, ob du das Modell auch auf demselben Server hostest.
Zwei Wege:
- Bring dein eigenes Modell. Hermes ruft einen OpenAI-kompatiblen Endpoint auf. Der VPS übernimmt nur die Orchestrierung. Mit 2 vCPU / 4 GB kommst du aus. Kosten: 5 bis 10 EUR im Monat.
- Das LLM selbst hosten. Jetzt benötigst du mindestens 16 GB RAM für ein 7B-Modell, 32 GB für 13B, und eine GPU, es sei denn, du magst 20-Sekunden-Antworten. Kosten: 100 EUR im Monat und mehr.
Die meisten starten mit Weg 1 und wechseln erst zu Weg 2, wenn sie Nutzungslimits erreichen oder ihre Gespräche komplett von externen APIs entkoppeln wollen.
VPS-Vergleich für Hermes Agent
| Anbieter | Plan | vCPU | RAM | Platte | Monatlich | Beste Verwendung |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CX23 | 2 | 4 GB | 40 GB NVMe | 5,49 EUR netto | BYO-Modell, die Standardwahl |
| Contabo | Cloud VPS 4 | 4 | 8 GB | 100 GB SSD | 5,50 EUR netto | BYO-Modell plus Zusatzdienste |
| Hetzner Cloud | CX33 | 4 | 8 GB | 80 GB NVMe | 8,49 EUR netto | Luft nach oben, auf NVMe |
| Hetzner Cloud | CCX13 | 2 | 8 GB | 80 GB NVMe | 42,99 EUR netto | Dedizierte vCPU, nur wenn nötig |
| Hetzner GPU | GEX44 | 14 | 64 GB | 2x 1,92 TB | 234 EUR + 114 Setup | Selbsthosting 13B Modell + Agent |
Hetzner und Contabo nennen Nettopreise, rechne also deine Umsatzsteuer dazu.
Hetzner Cloud CX23: Die Standardwahl für BYO-Modell-Setups
Für 5,49 EUR netto mit 2 vCPU und 4 GB ist das die ehrliche Standardwahl. Ein Hermes im Bring-your-own-Model-Modus belegt 300 bis 500 MB, du kaufst den Spielraum also für die Gateways und was sonst noch auf der Maschine läuft, nicht für den Agenten selbst. Die Latenz zu OpenAI und Anthropic von Falkenstein liegt unter 80 ms, was dem Hermes-Loop bei verketteten Tool-Calls zugutekommt.
Vorteile, die für Hermes relevant sind:
- Günstigster glaubwürdiger Plan, auf dem noch ein zweiter Dienst Platz hat
- API + Terraform erleichtert das erneute Deployment nach einem fehlerhaften Skill-Commit
- EU-Rechtsgebiet, wenn deine Messaging-Gateways Nutzer-PII enthalten
Steig auf den CX33 (4 vCPU / 8 GB, 8,49 EUR netto) um, wenn du zusätzlich die Transkription von Sprachnachrichten aktivierst. Sie zieht ffmpeg herein und ist die eine Hermes-Funktion, die wirklich CPU-hungrig ist.
Lass die Finger vom CCX13, solange du nicht genau weißt, warum du ihn willst. Er kostet 42,99 EUR netto für dieselben 8 GB wie der CX33, und bezahlt wird damit die dedizierte vCPU. Hermes verbringt seine Zeit wartend auf einen entfernten Modell-Endpunkt, geteilte vCPU ist also nicht sein Engpass. Dedizierte Kerne lohnen sich für lokale Inferenz oder eine laute Multi-Tenant-Last, nicht hierfür.
Hier kannst du Hetzner bekommen: Hetzner Cloud.
Contabo Cloud VPS 4: Das beste Preis-Leistungs-Verhältnis der Tabelle
Mit 5,50 EUR netto für 4 vCPU und 8 GB RAM schlägt Contabo alle anderen bei den Specs pro Euro: doppelt so viel RAM wie der CX23 für einen Cent mehr. Der Storage ist SSD statt NVMe, was Hermes nicht stört, aber die Bereitstellung dauert Stunden statt Sekunden.
Das, was niemand erwähnt: Contabos Netzwerk-Anbindung kann zu Spitzenzeiten langsam sein, wenn externe Modell-APIs aufgerufen werden, was 100 bis 300 ms zu jeder Hermes-Antwort hinzufügen kann. Ärgerlich, aber nicht fatal.
Vorteile:
- Das meiste RAM pro Euro von allen Plänen hier
- 4 vCPU sind für den Agenten allein überdimensioniert und genau richtig, sobald Sprachtranskription oder ein zweiter Dienst dazukommt
Hier bekommst du Contabo: Contabo.
DigitalOcean: Für US-basierte Setups
Wenn dein Modell-Endpoint, Slack-Arbeitsbereich und Team alle in US-East sind, gewinnt DigitalOcean NYC3 bei der Latenz. Der 1-Klick-Marktplatz ist für Hermes irrelevant, da es kein Template gibt, aber das Snapshot-System ist nützlich, um einen fehlerhaften Skill-Commit zurückzusetzen.
Ehrliche Nachteile: DigitalOcean kostet für dasselbe RAM ein Vielfaches von Hetzner oder Contabo, und das Droplet-Sortiment wurde 2026 umgebaut. Prüfe die aktuellen Tarifnamen und Preise auf der Preisseite des Anbieters statt einer Tabelle zu vertrauen - auch älteren Fassungen dieser hier.
So richtest du DigitalOcean ein: DigitalOcean.
Hetzner GEX44: Wenn du das LLM selbst hostest
Sobald du Hermes plus ein 13B-Modell auf demselben Rechner laufen lassen willst, brauchst du eine GPU. Der GEX44 mit einer RTX 4000 SFF Ada ist die günstigste ernstzunehmende Option in Europa mit 234 EUR im Monat plus 114 EUR Setup-Gebühr. Seine 20 GB VRAM fassen ein 13B in 4-Bit mit Platz für den Agenten daneben. Ein Llama 3.1 70B in 4-Bit braucht rund 40 GB und passt nicht — dafür ist der GEX131 mit 96 GB für 1.199 EUR im Monat zuständig.
Das ist Overkill für 90 % der Hermes-Nutzer. Wähle es nur, wenn du eine Datenschutzauflage hast, die externe API-Aufrufe ausschließt.
Was ich tatsächlich empfehlen würde
Wenn du heute startest und Hermes nur mit deiner Lieblingsmessaging-App laufen lassen willst:
- Am günstigsten, funktioniert: Hetzner CX23, 5,49 EUR netto
- Bestes Preis-Leistungs-Verhältnis: Contabo Cloud VPS 4, 5,50 EUR netto für 8 GB
- Sprachtranskription oder ein zweiter Dienst: Hetzner CX33, 8,49 EUR netto
- US-Team: DigitalOcean, aktuelle Preise auf deren Seite
- Datenschutz zuerst, eigenes Modell: Hetzner GEX44
Für das komplette Bild aller self-hosted Tools siehe den SelfHostVPS Vergleich. Das Hermes Agent Projekt entwickelt sich schnell, also aktualisiere ich diese Seite, sobald bedeutende Änderungen im Hauptzweig eintreten.
Frequently asked questions
Welche Mindest-VPS-Spezifikation benötigt Hermes Agent, um komfortabel zu laufen?
Wenn du Hermes auf eine remote Modell-Endpoint (OpenAI-kompatibel, Together, Anthropic) zeigst, sind 2 vCPU und 4 GB RAM die realistische Untergrenze. Der Agent selbst, der SQLite Skill-Store und die Messaging-Gateways sind nicht ressourcenintensiv. Sobald du das Inferenzenmodell auf demselben Server selbst hostest, benötigst du 16 GB RAM und eine GPU. Versuche nicht, CPU-Inferenz für einen Alltags-Agent, die Latenz würde die Schleife abwürgen.
Benötigt Hermes Agent eine GPU auf dem VPS?
Nur wenn du auch das Sprachmodell lokal laufen lässt. Hermes selbst ist eine Python-3.11-Orchestrationsschicht plus die Schleife, die Skills schreibt, der durch I/O und Token-Ausgaben vom Modell bound ist, nicht durch lokale Rechenleistung. Ein CPU-only Hetzner CCX oder Contabo-Server ist in Ordnung, wenn das Modell anderswo läuft. Hetzner GPU-Server oder Genesis Cloud sind die günstigsten GPU-Optionen in Europa.
Kann ich Hermes Agent auf einem 5-Dollar-VPS wie in den Docs behauptet laufen lassen?
Ja, aber nur im Bring-your-own-Model-Setup. Die offiziellen Anleitungen nennen eine 5-Dollar-Option, weil Hermes Ausgaben von einem Remote-Endpoint streamt, sodass der Agent nur wenig Ressourcen benötigt. Füge einen Telegram- und Slack-Gateway hinzu und du bist bei etwa 350 MB RAM, die dauerhaft belegt sind. Die 5-Dollar-Option scheitert, sobald du lokale Inferenz, Whisper-Transkription oder Visuelt tools aktivierst.
Braucht Hermes NVMe, oder reicht SSD?
SSD reicht. Hermes schreibt nach einer komplexen Aufgabe eine Skill-Datei und hängt an einen SQLite-FTS5-Index an - ein leichtes, schubweises Muster im Kilobyte-Bereich, nicht der Dauerdurchsatz, den ein Datenbankserver braucht. Contabo Cloud VPS 4 liefert SSD statt NVMe und lässt Hermes problemlos laufen. NVMe lohnt sich, wenn du zusätzlich das Modell selbst hostest und mehrere Gigabyte Gewichte von der Platte lädst, denn dann bezahlst du tatsächlich für die sequenzielle Lesegeschwindigkeit.