Dernière vérification:
Hermes Agent, lancé en février 2026, est à 237K étoiles sur GitHub en août 2026. La plupart du buzz est justifié, la boucle qui écrit ses propres compétences réduit réellement le coût des tâches répétées, mais les conseils d’hébergement qui circulent actuellement sont catastrophiques. La moitié des discussions vous disent qu’un VPS à 5 dollars suffit. L’autre vous pousse à prendre une H100. Les deux ont raison pour des configurations différentes, et la plupart des gens font le mauvais choix.
Voici ce que j’ai réellement testé après trois semaines d’utilisation de Hermes avec les passerelles Telegram, Discord et Slack pointées dessus.
Ce dont Hermes a réellement besoin d’un VPS
Le processus de l’agent lui-même est léger. Python, un store de compétences SQLite, les démons de passerelle, peut-être 300 à 500 MB de mémoire résidentielle au total. La seule chose qui détermine votre facture, c’est si vous hébergez également le modèle sur la même machine.
Deux options :
- Apportez votre propre modèle. Hermes appelle un endpoint compatible OpenAI. Le VPS ne fait que gérer l’orchestration. Vous pouvez vous en sortir avec 2 vCPU / 4 GB. Coût : 5 à 10 EUR par mois.
- Hébergez aussi le LLM en self-hosting. Alors, il vous faut au minimum 16 GB de RAM pour un modèle 7B, 32 GB pour 13B, et vous souhaitez un GPU à moins que vous n’appréciiez des réponses en 20 secondes. Coût : 100 EUR ou plus par mois.
La majorité commence avec la première option et passe à la seconde dès qu’ils atteignent des limites d’utilisation ou pour que leurs conversations soient complètement indépendantes des APIs externes.
Comparatif de VPS pour Hermes Agent
| Fournisseur | Plan | vCPU | RAM | Disque | Mensuel | Idéal pour |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CX23 | 2 | 4 Go | 40 Go NVMe | 5,49 EUR HT | Modèle BYO, le choix par défaut |
| Contabo | Cloud VPS 4 | 4 | 8 Go | 100 Go SSD | 5,50 EUR HT | Modèle BYO plus services annexes |
| Hetzner Cloud | CX33 | 4 | 8 Go | 80 Go NVMe | 8,49 EUR HT | De la marge, sur NVMe |
| Hetzner Cloud | CCX13 | 2 | 8 Go | 80 Go NVMe | 42,99 EUR HT | vCPU dédié, seulement si nécessaire |
| Hetzner GPU | GEX44 | 14 | 64 Go | 2x 1,92 To | 234 EUR + 114 install. | Héberger un modèle 13B + agent |
Hetzner et Contabo affichent des prix hors taxes, ajoutez votre TVA.
Hetzner Cloud CX23 : le choix par défaut pour les configurations BYO-model
À 5,49 EUR HT pour 2 vCPU et 4 Go, c’est le choix par défaut honnête. Un Hermes en mode bring-your-own-model occupe 300 à 500 Mo : vous achetez de la marge pour les passerelles et ce qui tourne à côté, pas pour l’agent lui-même. La latence vers OpenAI et Anthropic depuis Falkenstein est inférieure à 80 ms, ce qui profite à la boucle Hermes lors des appels d’outils en chaîne.
Les avantages qui comptent pour Hermes :
- L’offre crédible la moins chère qui laisse encore la place à un second service
- API + Terraform simplifient le redéploiement après une compétence mal écrite
- Juridiction européenne si vos passerelles transportent des données personnelles
Passez au CX33 (4 vCPU / 8 Go, 8,49 EUR HT) si vous activez aussi la transcription des messages vocaux : elle embarque ffmpeg et c’est la seule fonction d’Hermes réellement gourmande en CPU.
Évitez le CCX13 tant que vous ne savez pas précisément pourquoi vous le voulez. Il coûte 42,99 EUR HT pour les mêmes 8 Go que le CX33, et ce que vous payez, c’est le vCPU dédié. Hermes passe son temps à attendre un point de terminaison distant, le vCPU partagé n’est donc pas son goulot d’étranglement. Les cœurs dédiés valent leur prix pour de l’inférence locale ou une charge multi-locataire bruyante, pas pour cet usage.
Prendre Hetzner ici : Hetzner Cloud.
Contabo Cloud VPS 4 : le meilleur rapport qualité-prix du tableau
À 5,50 EUR HT pour 4 vCPU et 8 Go de RAM, personne ne bat Contabo sur les specs par euro : deux fois la RAM du CX23 pour un centime de plus. Le stockage est en SSD plutôt qu’en NVMe, ce dont Hermes se moque, mais le provisionnement prend des heures plutôt que des secondes.
Ce que personne ne mentionne : le réseau sortant de Contabo peut ralentir aux heures de pointe lors des appels aux API de modèles, ce qui ajoute 100 à 300 ms à chaque tour d’Hermes. Agaçant, mais pas rédhibitoire.
Avantages :
- Le plus de RAM par euro de tous les plans présentés ici
- 4 vCPU, c’est surdimensionné pour l’agent seul et exactement ce qu’il faut dès que vous ajoutez la transcription vocale ou un second service
Prendre Contabo : Contabo.
DigitalOcean : pour les stacks basés aux US
Si votre point de terminaison, votre espace Slack et votre équipe sont tous en US-east, la région NYC3 de DigitalOcean gagne sur la latence. La place de marché en 1 clic est sans intérêt pour Hermes faute de template, mais le système de snapshots est vraiment utile pour revenir en arrière après une compétence mal écrite.
Inconvénients honnêtes : DigitalOcean coûte plusieurs fois le prix de Hetzner ou Contabo pour la même RAM, et la gamme de droplets a été restructurée en 2026. Vérifiez les noms d’offres et les tarifs actuels sur leur page de prix plutôt que de faire confiance à un tableau - y compris aux versions plus anciennes de celui-ci.
Configurer DigitalOcean : DigitalOcean.
Hetzner GEX44 : si vous hébergez vous-même le LLM
Dès que vous souhaitez faire tourner Hermes avec un modèle 13B sur la même machine, il faut un GPU. Le GEX44 avec une RTX 4000 SFF Ada est la solution sérieuse la moins chère en Europe à 234 EUR par mois plus 114 EUR d’installation. Ses 20 GB de VRAM accueillent un 13B en 4 bits avec de la place pour l’agent à côté. Un Llama 3.1 70B en 4 bits réclame environ 40 GB et ne tiendra pas : c’est le rôle du GEX131 et de ses 96 GB, à 1 199 EUR par mois.
C’est overkill pour 90 % des utilisateurs Hermes. Ne le choisissez que si vous avez une exigence de confidentialité excluant les appels API externes.
Ce que je choisirais réellement
Si vous démarrez aujourd’hui et que vous souhaitez simplement faire tourner Hermes avec votre appli de messagerie préférée :
- Le moins cher qui fonctionne : Hetzner CX23, 5,49 EUR HT
- Meilleur rapport qualité-prix : Contabo Cloud VPS 4, 5,50 EUR HT pour 8 Go
- Transcription vocale ou second service : Hetzner CX33, 8,49 EUR HT
- Équipe US : DigitalOcean, tarifs actuels sur leur site
- Priorité confidentialité, auto-hébergement du modèle : Hetzner GEX44
Pour avoir une vision complète de tous les outils en self-hosting, consultez la SelfHostVPS comparison. Le projet Hermes Agent évolue rapidement, donc cet article sera mis à jour quand des changements importants seront intégrés à la branche principale.
Frequently asked questions
Quelle est la configuration minimale de VPS pour faire fonctionner confortablement Hermes Agent ?
Si vous pointez Hermes vers un point de terminaison modèle distant (compatible OpenAI, Together, Anthropic), 2 vCPU et 4 GB de RAM constituent le minimum réaliste. L'agent lui-même, le store de compétences SQLite, et les passerelles de messagerie ne sont pas gourmands. Dès que vous hébergez l'inférence du modèle sur la même machine, vous avez besoin de 16 GB de RAM et d'un GPU. N'essayez pas l'inférence CPU pour un agent à usage quotidien, la latence tue la boucle.
Hermes Agent a-t-il besoin d'un GPU sur le VPS ?
Seulement si vous faites aussi tourner le modèle de langage localement. Hermes lui-même est une couche d'orchestration Python 3.11 plus la boucle qui écrit ses compétences, qui est limitée par l'I/O et les tokens générés par le modèle, pas par la puissance de calcul locale. Un serveur Hetzner CCX ou Contabo uniquement CPU fonctionne quand le modèle est hébergé ailleurs. Les serveurs GPU Hetzner ou Genesis Cloud sont les options GPU les moins chères en Europe.
Puis-je faire fonctionner Hermes Agent sur un VPS à 5 dollars comme le prétendent les docs ?
Oui, mais seulement dans la configuration 'apportez votre propre modèle'. Les docs officiels mentionnent une gamme à 5 dollars car Hermes diffuse les complétions depuis un point de terminaison distant, donc l'empreinte de l'agent est faible. Ajoutez une passerelle Telegram et Slack et vous utilisez environ 350 MB de RAM en résident. La gamme à 5 dollars échoue dès que vous activez l'inférence locale, la transcription Whisper, ou les outils de vision.
Hermes a-t-il besoin de NVMe, ou le SSD suffit-il ?
Le SSD suffit. Après une tâche complexe, Hermes écrit un fichier de compétence et complète un index SQLite FTS5 : un motif léger et ponctuel qui se mesure en kilo-octets, pas le débit soutenu qu'exige un serveur de base de données. Le Contabo Cloud VPS 4 est livré en SSD et fait tourner Hermes sans problème. Le NVMe se justifie quand vous hébergez aussi le modèle et chargez plusieurs gigaoctets de poids depuis le disque, car c'est alors la vitesse de lecture séquentielle que vous payez.