Ultima verifica:
Khoj è il secondo cervello open source più curato che abbia mai usato. Indicizza le tue note, i documenti e la posta, esegue sopra un server di ricerca semantica e ti offre un agente di chat che si fonda davvero sui tuoi contenuti. Il quadro dell’hosting è cambiato a fine 2025, quando Khoj ha aggiunto automazioni programmate e ricerca approfondita, entrambe le quali spingono verso l’alto la curva delle risorse.
Faccio girare Khoj su Hetzner da quattordici settimane, con circa 12.000 documenti indicizzati tra Obsidian, PDF e una sincronizzazione Gmail. Ecco cosa la documentazione non ti dice sulla scelta del VPS.
Di cosa ha davvero bisogno Khoj
Tre cose da dimensionare:
- Il server Khoj. FastAPI più l’orchestrazione di ricerca e chat. 300-500 MB residenti in uso normale.
- L’indice di embeddings. Questo è il pezzo grosso. Circa 1,5 GB ogni 10.000 documenti con il modello predefinito. Con corpus più grandi conviene tenerlo tutto in RAM.
- I job in background. Il modulo di automazioni, i workflow di ricerca approfondita e le pipeline di ingestione generano tutti dei worker propri. Prevedi margine anche se il tuo regime stazionario è basso.
Quello che sorprende: Khoj genera gli embeddings localmente per impostazione predefinita. Su una macchina a 2 vCPU, l’indicizzazione iniziale di un corpus di 5.000 documenti richiede 30-90 minuti. Metti in conto questo tempo di avvio e non allarmarti se la CPU resta al 100 per cento.
Confronto VPS per Khoj
| Provider | Plan | vCPU | RAM | Disco | Mensile | Adatto a |
|---|---|---|---|---|---|---|
| Hetzner Cloud | CCX13 | 2 | 8 GB | 80 GB NVMe | 42.99 EUR | Scelta predefinita per uso personale |
| Contabo VPS | VPS S | 4 | 8 GB | 100 GB NVMe | 4.50 EUR | Scelta economica, utente singolo |
| DigitalOcean | Premium AMD 4 GB | 2 | 8 GB | 100 GB NVMe | 28 USD | Team USA, corpus medio |
| Hetzner Cloud | CCX23 | 4 | 16 GB | 160 GB NVMe | 85.99 EUR | Corpus di grandi dimensioni oltre 30K documenti |
Hetzner Cloud CCX13: la scelta che dovrebbero fare i più
Questo è ciò che uso io. L’NVMe fa una differenza reale per Khoj perché l’indice di embeddings viene letto intensamente durante la ricerca, e l’I/O di Hetzner è abbastanza costante da evitare quei pomeriggi lenti che alcune piattaforme cloud hanno. 8 GB di RAM ospitano comodamente un corpus di 15.000 documenti con margine per i worker di chat e automazioni.
Vantaggi per Khoj:
- Latenza sotto 80 ms verso OpenAI, Anthropic e la maggior parte dei provider di modelli da Falkenstein
- Gli snapshot rendono facile tornare indietro dopo un aggiornamento di Khoj andato male
- 20 TB di traffico in uscita sono generosi a meno di rigenerazioni intensive degli embeddings
Svantaggio reale: il livello CCX più economico si ferma a 8 GB. Oltre i 30.000 documenti passerei al CCX23.
Ottieni Hetzner: Hetzner Cloud.
Contabo VPS S: scelta economica per utenti singoli
A 4,50 euro al mese, il rapporto qualità-prezzo è difficile da ignorare. I piani NVMe più recenti di Contabo gestiscono senza problemi il pattern di I/O di Khoj per corpus piccoli e medi. I compromessi sono quelli noti:
- Il provisioning è lento, a volte richiede ore
- La latenza in uscita verso le API dei modelli è di 100-200 ms più lenta rispetto a Hetzner dai data center europei
- Il livello più economico usa CPU condivisa, il che allunga la rigenerazione degli embeddings su un host occupato
Per un utente singolo che indicizza le proprie note una volta sola e legge molto, vince il prezzo.
Ottieni Contabo: Contabo VPS.
DigitalOcean Premium AMD 4 GB: per configurazioni sulla costa est USA
Se il tuo endpoint del modello è sulla costa est USA, NYC3 riduce la latenza a ogni andata e ritorno della chat. Il piano Premium AMD da 8 GB basta per un corpus Khoj di dimensioni medie, e la CPU AMD rigenera gli embeddings notevolmente più veloce rispetto ai vecchi piani condivisi.
Svantaggio onesto: 28 USD al mese per 8 GB è caro rispetto a Hetzner. Paghi per la regione.
Ottieni DigitalOcean: DigitalOcean.
Hetzner Cloud CCX23: per corpus di grandi dimensioni
Una volta superati i 30.000 documenti indicizzati, l’indice diventa troppo grande per stare comodamente in 8 GB. Il CCX23 con 16 GB di RAM e 4 vCPU ti dà il margine per un corpus in crescita. È anche la scelta giusta se vuoi attivare la ricerca approfondita e farla girare senza intoppi accanto alla chat quotidiana.
Ottieni Hetzner: Hetzner Cloud.
Tre cose che avrei voluto sapere prima
- L’indicizzazione iniziale è lenta su CPU condivisa. Metti in conto 60-90 minuti su un piccolo VPS per un corpus di 10.000 documenti. Dopo, l’indicizzazione incrementale è veloce.
- La scelta del modello di embeddings conta. Il modello predefinito va bene. Passare a un modello più grande raddoppia la dimensione dell’indice su disco e in memoria. Ne vale la pena per alcuni casi d’uso, non per tutti.
- Fai il backup della directory dei dati. Perdere l’indice significa reindicizzare tutto. Configura rsync o snapshot dei volumi fin dal primo giorno.
Cosa sceglierei davvero
Se parti oggi:
- UE, uso personale: Hetzner CCX13
- UE, spesa minima: Contabo VPS S
- Costa est USA: DigitalOcean Premium AMD 8 GB
- Oltre 30K documenti: Hetzner CCX23 o superiore
Per il quadro più ampio del self-hosting, vedi il confronto SelfHostVPS. Khoj continua a rilasciare nuove funzionalità, quindi aggiorno questa pagina quando il livello di indicizzazione o chat cambia in modo significativo.
Frequently asked questions
Qual è la configurazione minima di VPS per Khoj?
2 vCPU e 4 GB di RAM se punti Khoj verso un'API di modello remota e mantieni i contenuti indicizzati sotto qualche migliaio di documenti. Il server Python, la cache degli embeddings e l'indice di ricerca restano comodamente sotto i 2 GB a questa scala. Con corpus più grandi conviene passare a 8 GB perché l'indice vettoriale resti in memoria.
Khoj ha bisogno di una GPU sul VPS?
Solo se ospiti tu stesso il modello linguistico. La generazione degli embeddings è amichevole per la CPU e Khoj la elabora bene in batch. Il lato chat chiama il provider che configuri, che può essere Anthropic, OpenAI, un'istanza locale di Ollama o un endpoint vLLM remoto. I piani VPS solo CPU sono la configurazione normale.
Khoj può girare su un server Contabo da 5 dollari?
Sì, per un singolo utente con un corpus personale piccolo. Comincia a rallentare superati i 5.000 documenti o note indicizzate, soprattutto perché l'indice di embeddings dipende molto dalla cache delle pagine e i piani Contabo più economici non sono pensati per questo pattern. I 4 euro in più evitano del tutto il rallentamento.
Quanto spazio disco devo prevedere per Khoj?
Prevedi almeno 1,5 volte la dimensione dei tuoi contenuti grezzi per l'indice di embeddings, più 5-10 GB per l'ambiente Python e Khoj stesso. 80 GB NVMe bastano per quasi tutti. Se importi PDF di grandi dimensioni o un vault Obsidian accumulato negli anni, prevedi 160 GB.