Dernière vérification:
Khoj est le second cerveau open source le plus abouti que j’ai utilisé. Il indexe vos notes, documents et e-mails, fait tourner un serveur de recherche sémantique par-dessus, et vous donne un agent de chat qui s’ancre réellement dans votre contenu. Le paysage de l’hébergement a changé fin 2025 quand Khoj a ajouté les automatisations planifiées et la recherche approfondie, deux fonctionnalités qui font grimper la courbe de ressources.
Je fais tourner Khoj sur Hetzner depuis quatorze semaines, avec environ 12 000 documents indexés répartis entre Obsidian, des PDF et une synchronisation Gmail. Voici ce que la documentation ne vous dit pas sur le choix du VPS.
Ce dont Khoj a réellement besoin
Trois éléments à dimensionner :
- Le serveur Khoj. FastAPI plus l’orchestration de la recherche et du chat. 300 à 500 Mo résidents en usage normal.
- L’index d’embeddings. C’est le gros morceau. Environ 1,5 Go pour 10 000 documents avec le modèle par défaut. Pour des corpus plus volumineux, mieux vaut le garder entièrement en RAM.
- Les tâches de fond. Le module d’automatisations, les workflows de recherche approfondie et les pipelines d’ingestion lancent tous des workers. Prévoyez de la marge même si votre régime permanent est faible.
Ce qui surprend beaucoup de monde : Khoj génère les embeddings localement par défaut. Sur une machine à 2 vCPU, l’indexation initiale d’un corpus de 5 000 documents prend 30 à 90 minutes. Prévoyez ce temps de démarrage et ne paniquez pas si le CPU reste à 100 %.
Comparatif VPS pour Khoj
| Provider | Plan | vCPU | RAM | Disque | Mensuel | Idéal pour |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CCX13 | 2 | 8 GB | 80 GB NVMe | 42,99 EUR | Choix par défaut pour un usage personnel |
| Contabo VPS | VPS S | 4 | 8 GB | 100 GB NVMe | 4,50 EUR | Choix économique, utilisateur unique |
| DigitalOcean | Premium AMD 4 GB | 2 | 8 GB | 100 GB NVMe | 28 USD | Équipe US, corpus moyen |
| Hetzner Cloud | CCX23 | 4 | 16 GB | 160 GB NVMe | 85,99 EUR | Corpus volumineux au-delà de 30 000 documents |
Hetzner Cloud CCX13 : le choix que la plupart des gens devraient faire
C’est ce que j’utilise. Le NVMe fait une vraie différence pour Khoj car l’index d’embeddings est fortement sollicité en lecture pendant la recherche, et les I/O de Hetzner sont assez régulières pour éviter les après-midis ralenties que connaissent certaines plateformes cloud. 8 Go de RAM contiennent confortablement un corpus de 15 000 documents, avec de la marge pour les workers de chat et d’automatisation.
Avantages pour Khoj :
- Latence sous 80 ms vers OpenAI, Anthropic et la plupart des fournisseurs de modèles depuis Falkenstein
- Les snapshots facilitent le retour en arrière après une mauvaise mise à jour de Khoj
- 20 To de trafic sortant, ce qui est généreux sauf en cas de régénération massive des embeddings
Vrai inconvénient : le palier CCX le moins cher plafonne à 8 Go. Au-delà de 30 000 documents, je passerais au CCX23.
Obtenir Hetzner : Hetzner Cloud.
Contabo VPS S : le choix économique pour les utilisateurs solo
À 4,50 euros par mois, le rapport qualité-prix est difficile à ignorer. Les plans Contabo NVMe plus récents gèrent sans problème le schéma d’I/O de Khoj pour des corpus petits à moyens. Les compromis sont connus :
- Le provisionnement est lent, parfois des heures
- La latence sortante vers les API de modèles est 100 à 200 ms plus lente que Hetzner depuis les datacenters européens
- Le palier le moins cher utilise un CPU partagé, ce qui allonge la régénération des embeddings sur un hôte chargé
Pour un utilisateur unique qui indexe ses notes une fois et lit beaucoup, le prix l’emporte.
Obtenir Contabo : Contabo VPS.
DigitalOcean Premium AMD 4 Go : pour les installations sur la côte est américaine
Si votre point de terminaison de modèle est sur la côte est américaine, NYC3 réduit la latence à chaque aller-retour de chat. Le plan Premium AMD à 8 Go suffit pour un corpus Khoj de taille moyenne, et le CPU AMD régénère les embeddings nettement plus vite que les anciens plans partagés.
Point négatif honnête : 28 USD par mois pour 8 Go, c’est cher face à Hetzner. Vous payez pour la région.
Obtenir DigitalOcean : DigitalOcean.
Hetzner Cloud CCX23 : pour les corpus volumineux
Une fois au-delà de 30 000 documents indexés, l’index devient trop volumineux pour tenir confortablement dans 8 Go. Le CCX23 avec 16 Go de RAM et 4 vCPU vous donne la marge nécessaire pour un corpus qui grandit. C’est aussi le bon choix si vous voulez activer la recherche approfondie et la faire tourner sans accroc à côté du chat quotidien.
Obtenir Hetzner : Hetzner Cloud.
Trois choses que j’aurais aimé savoir avant
- L’indexation initiale est lente sur un CPU partagé. Prévoyez 60 à 90 minutes sur un petit VPS pour un corpus de 10 000 documents. Ensuite, l’indexation incrémentale est rapide.
- Le choix du modèle d’embeddings compte. Le modèle par défaut est bon. Passer à un modèle plus grand double la taille de l’index sur disque et en mémoire. Cela vaut le coup pour certains usages, pas pour tous.
- Sauvegardez le répertoire de données. Perdre l’index signifie tout ré-indexer. Mettez en place rsync ou des snapshots de volume dès le premier jour.
Ce que je choisirais vraiment
Si vous démarrez aujourd’hui :
- UE, usage personnel : Hetzner CCX13
- UE, dépense minimale : Contabo VPS S
- Côte est américaine : DigitalOcean Premium AMD 8 GB
- Plus de 30 000 documents : Hetzner CCX23 ou plus
Pour la vue d’ensemble de l’auto-hébergement, consultez le comparatif SelfHostVPS. Khoj continue de sortir de nouvelles fonctionnalités, donc j’actualise cette page dès que la couche d’indexation ou de chat change de manière significative.
Frequently asked questions
Quelle configuration VPS minimale faut-il pour Khoj ?
2 vCPU et 4 Go de RAM suffisent si Khoj pointe vers une API de modèle distante et que votre contenu indexé reste sous quelques milliers de documents. Le serveur Python, le cache d'embeddings et l'index de recherche restent confortablement sous 2 Go à cette échelle. Pour des corpus plus volumineux, visez 8 Go afin que l'index vectoriel reste en mémoire.
Khoj a-t-il besoin d'un GPU sur le VPS ?
Seulement si vous auto-hébergez le modèle de langage. La génération d'embeddings est adaptée au CPU et Khoj la traite efficacement par lots. Le chat appelle le fournisseur que vous configurez, qu'il s'agisse d'Anthropic, OpenAI, un Ollama local ou un point de terminaison vLLM distant. Les plans VPS CPU seul sont la configuration habituelle.
Khoj peut-il tourner sur un serveur Contabo à 5 dollars ?
Oui, pour un utilisateur unique avec un petit corpus personnel. Cela commence à ralentir au-delà de 5 000 notes ou documents indexés, surtout parce que l'index d'embeddings sollicite le cache de pages et que les plans Contabo les moins chers ne sont pas conçus pour ce schéma. Les 4 euros supplémentaires évitent entièrement ce ralentissement.
Combien d'espace disque prévoir pour Khoj ?
Prévoyez au moins 1,5 fois la taille de votre contenu brut pour l'index d'embeddings, plus 5 à 10 Go pour l'environnement Python et Khoj lui-même. 80 Go de NVMe suffisent pour presque tout le monde. Pour de gros PDF ou un coffre Obsidian accumulé sur plusieurs années, prévoyez 160 Go.