Tests indépendants Mis à jour août 2026 387 guides d'auto-hébergement 5 fournisseurs VPS testés

comparison

Meilleur VPS pour Hermes Agent (2026) : Choix de la RAM réelle + GPU

Héberger vous-même l'Hermes Agent de Nous Research ? Voici ce qui correspond réellement à la charge de travail, ainsi que le VPS bon marché qui va le faire échouer.

Dernière vérification:

Hermes Agent, lancé en février 2026, est à 237K étoiles sur GitHub en août 2026. La plupart du buzz est justifié, la boucle qui écrit ses propres compétences réduit réellement le coût des tâches répétées, mais les conseils d’hébergement qui circulent actuellement sont catastrophiques. La moitié des discussions vous disent qu’un VPS à 5 dollars suffit. L’autre vous pousse à prendre une H100. Les deux ont raison pour des configurations différentes, et la plupart des gens font le mauvais choix.

Voici ce que j’ai réellement testé après trois semaines d’utilisation de Hermes avec les passerelles Telegram, Discord et Slack pointées dessus.

Ce dont Hermes a réellement besoin d’un VPS

Le processus de l’agent lui-même est léger. Python, un store de compétences SQLite, les démons de passerelle, peut-être 300 à 500 MB de mémoire résidentielle au total. La seule chose qui détermine votre facture, c’est si vous hébergez également le modèle sur la même machine.

Deux options :

  1. Apportez votre propre modèle. Hermes appelle un endpoint compatible OpenAI. Le VPS ne fait que gérer l’orchestration. Vous pouvez vous en sortir avec 2 vCPU / 4 GB. Coût : 5 à 10 EUR par mois.
  2. Hébergez aussi le LLM en self-hosting. Alors, il vous faut au minimum 16 GB de RAM pour un modèle 7B, 32 GB pour 13B, et vous souhaitez un GPU à moins que vous n’appréciiez des réponses en 20 secondes. Coût : 100 EUR ou plus par mois.

La majorité commence avec la première option et passe à la seconde dès qu’ils atteignent des limites d’utilisation ou pour que leurs conversations soient complètement indépendantes des APIs externes.

Comparatif de VPS pour Hermes Agent

FournisseurPlanvCPURAMDisqueMensuelIdéal pour
Hetzner CloudCX2324 Go40 Go NVMe5,49 EUR HTModèle BYO, le choix par défaut
ContaboCloud VPS 448 Go100 Go SSD5,50 EUR HTModèle BYO plus services annexes
Hetzner CloudCX3348 Go80 Go NVMe8,49 EUR HTDe la marge, sur NVMe
Hetzner CloudCCX1328 Go80 Go NVMe42,99 EUR HTvCPU dédié, seulement si nécessaire
Hetzner GPUGEX441464 Go2x 1,92 To234 EUR + 114 install.Héberger un modèle 13B + agent

Hetzner et Contabo affichent des prix hors taxes, ajoutez votre TVA.

Hetzner Cloud CX23 : le choix par défaut pour les configurations BYO-model

À 5,49 EUR HT pour 2 vCPU et 4 Go, c’est le choix par défaut honnête. Un Hermes en mode bring-your-own-model occupe 300 à 500 Mo : vous achetez de la marge pour les passerelles et ce qui tourne à côté, pas pour l’agent lui-même. La latence vers OpenAI et Anthropic depuis Falkenstein est inférieure à 80 ms, ce qui profite à la boucle Hermes lors des appels d’outils en chaîne.

Les avantages qui comptent pour Hermes :

Passez au CX33 (4 vCPU / 8 Go, 8,49 EUR HT) si vous activez aussi la transcription des messages vocaux : elle embarque ffmpeg et c’est la seule fonction d’Hermes réellement gourmande en CPU.

Évitez le CCX13 tant que vous ne savez pas précisément pourquoi vous le voulez. Il coûte 42,99 EUR HT pour les mêmes 8 Go que le CX33, et ce que vous payez, c’est le vCPU dédié. Hermes passe son temps à attendre un point de terminaison distant, le vCPU partagé n’est donc pas son goulot d’étranglement. Les cœurs dédiés valent leur prix pour de l’inférence locale ou une charge multi-locataire bruyante, pas pour cet usage.

Prendre Hetzner ici : Hetzner Cloud.

Contabo Cloud VPS 4 : le meilleur rapport qualité-prix du tableau

À 5,50 EUR HT pour 4 vCPU et 8 Go de RAM, personne ne bat Contabo sur les specs par euro : deux fois la RAM du CX23 pour un centime de plus. Le stockage est en SSD plutôt qu’en NVMe, ce dont Hermes se moque, mais le provisionnement prend des heures plutôt que des secondes.

Ce que personne ne mentionne : le réseau sortant de Contabo peut ralentir aux heures de pointe lors des appels aux API de modèles, ce qui ajoute 100 à 300 ms à chaque tour d’Hermes. Agaçant, mais pas rédhibitoire.

Avantages :

Prendre Contabo : Contabo.

DigitalOcean : pour les stacks basés aux US

Si votre point de terminaison, votre espace Slack et votre équipe sont tous en US-east, la région NYC3 de DigitalOcean gagne sur la latence. La place de marché en 1 clic est sans intérêt pour Hermes faute de template, mais le système de snapshots est vraiment utile pour revenir en arrière après une compétence mal écrite.

Inconvénients honnêtes : DigitalOcean coûte plusieurs fois le prix de Hetzner ou Contabo pour la même RAM, et la gamme de droplets a été restructurée en 2026. Vérifiez les noms d’offres et les tarifs actuels sur leur page de prix plutôt que de faire confiance à un tableau - y compris aux versions plus anciennes de celui-ci.

Configurer DigitalOcean : DigitalOcean.

Hetzner GEX44 : si vous hébergez vous-même le LLM

Dès que vous souhaitez faire tourner Hermes avec un modèle 13B sur la même machine, il faut un GPU. Le GEX44 avec une RTX 4000 SFF Ada est la solution sérieuse la moins chère en Europe à 234 EUR par mois plus 114 EUR d’installation. Ses 20 GB de VRAM accueillent un 13B en 4 bits avec de la place pour l’agent à côté. Un Llama 3.1 70B en 4 bits réclame environ 40 GB et ne tiendra pas : c’est le rôle du GEX131 et de ses 96 GB, à 1 199 EUR par mois.

C’est overkill pour 90 % des utilisateurs Hermes. Ne le choisissez que si vous avez une exigence de confidentialité excluant les appels API externes.

Ce que je choisirais réellement

Si vous démarrez aujourd’hui et que vous souhaitez simplement faire tourner Hermes avec votre appli de messagerie préférée :

Pour avoir une vision complète de tous les outils en self-hosting, consultez la SelfHostVPS comparison. Le projet Hermes Agent évolue rapidement, donc cet article sera mis à jour quand des changements importants seront intégrés à la branche principale.

Frequently asked questions

Quelle est la configuration minimale de VPS pour faire fonctionner confortablement Hermes Agent ?

Si vous pointez Hermes vers un point de terminaison modèle distant (compatible OpenAI, Together, Anthropic), 2 vCPU et 4 GB de RAM constituent le minimum réaliste. L'agent lui-même, le store de compétences SQLite, et les passerelles de messagerie ne sont pas gourmands. Dès que vous hébergez l'inférence du modèle sur la même machine, vous avez besoin de 16 GB de RAM et d'un GPU. N'essayez pas l'inférence CPU pour un agent à usage quotidien, la latence tue la boucle.

Hermes Agent a-t-il besoin d'un GPU sur le VPS ?

Seulement si vous faites aussi tourner le modèle de langage localement. Hermes lui-même est une couche d'orchestration Python 3.11 plus la boucle qui écrit ses compétences, qui est limitée par l'I/O et les tokens générés par le modèle, pas par la puissance de calcul locale. Un serveur Hetzner CCX ou Contabo uniquement CPU fonctionne quand le modèle est hébergé ailleurs. Les serveurs GPU Hetzner ou Genesis Cloud sont les options GPU les moins chères en Europe.

Puis-je faire fonctionner Hermes Agent sur un VPS à 5 dollars comme le prétendent les docs ?

Oui, mais seulement dans la configuration 'apportez votre propre modèle'. Les docs officiels mentionnent une gamme à 5 dollars car Hermes diffuse les complétions depuis un point de terminaison distant, donc l'empreinte de l'agent est faible. Ajoutez une passerelle Telegram et Slack et vous utilisez environ 350 MB de RAM en résident. La gamme à 5 dollars échoue dès que vous activez l'inférence locale, la transcription Whisper, ou les outils de vision.

Hermes a-t-il besoin de NVMe, ou le SSD suffit-il ?

Le SSD suffit. Après une tâche complexe, Hermes écrit un fichier de compétence et complète un index SQLite FTS5 : un motif léger et ponctuel qui se mesure en kilo-octets, pas le débit soutenu qu'exige un serveur de base de données. Le Contabo Cloud VPS 4 est livré en SSD et fait tourner Hermes sans problème. Le NVMe se justifie quand vous hébergez aussi le modèle et chargez plusieurs gigaoctets de poids depuis le disque, car c'est alors la vitesse de lecture séquentielle que vous payez.