Jan Server ist eine Multi-Service-Plattform statt einer einzelnen Anwendung, und seine Anforderungen spiegeln das wider. Das README des Projekts setzt die Grenze bei mindestens 8 GB RAM, empfohlen 12 GB, was die 4-GB-Pläne ausschließt, die günstige VPS-Vergleiche dominieren.
Im Folgenden schlüsseln wir diese Zahl auf und zeigen, welche Teile sich verschieben, wenn sich Ihre Konfiguration ändert.
Wohin der Arbeitsspeicher fließt
Ein Standard-Deployment startet rund neun Container. Keiner davon ist für sich genommen riesig, aber sie summieren sich:
- Go-Microservices — LLM API, Response API, Media API, MCP-Tools und eine Service-Vorlage
- PostgreSQL — Persistenz von Konversationen und Nachrichten
- Keycloak — OIDC-Authentifizierung, läuft aus
quay.io/keycloak/keycloak:24.0.5und ist eine JVM-Anwendung mit spürbarem Speicherbedarf - Kong v3.5 — das API-Gateway, das jede Anfrage validiert
- Web-Chat-UI — eine React-App auf Port 3001
Keycloak und Postgres sind die beiden, die 4 GB unangenehm eng machen. Auf einem 8-GB-Server läuft der Stack mit Luft nach oben; darunter werden Container beim Start per OOM-Killer beendet, und der Fehler wirkt eher wie ein zufälliger Absturz als wie ein Speicherproblem.
Die Empfehlung von 12 GB gilt, wenn Sie alles aktivieren, einschließlich der Media API und des optionalen Observability-Stacks aus OpenTelemetry, Prometheus, Jaeger und Grafana.
CPU
Die Go-Dienste sind nicht CPU-gebunden. Sie verbringen ihre Zeit mit Warten auf die Datenbank und auf den konfigurierten Modell-Endpunkt, weshalb 4 vCPU für den gesamten Stack komfortabel sind und 2 vCPU für eine Einzelnutzer-Installation reichen.
Das ändert sich vollständig, wenn Sie Inferenz auf derselben Maschine betreiben. Genau dafür gibt es das CPU-vLLM-Profil, das jeden verfügbaren Kern nutzt und dabei Tokens weit langsamer erzeugt als eine GPU. Behandeln Sie CPU-Inferenz als Mittel, um zu prüfen, ob das Deployment funktioniert — nicht als Konfiguration, mit der Sie Nutzer bedienen.
Festplatte
Planen Sie mindestens 40 GB bei entfernter Inferenz ein. Drei Dinge verbrauchen davon:
- Container-Images — mehrere Gigabyte über die Dienste, Keycloak, Kong und Postgres verteilt
- PostgreSQL-Daten — wachsen mit dem Konversations- und Nachrichtenverlauf
- Medienspeicher — nur, wenn Sie die Media API aktivieren und Dateien lokal statt in S3 halten
Lokale Modellgewichte sind der unsichere Faktor. Das Standardmodell für die vLLM-Profile ist janhq/Jan-v1-4B, was bescheiden ausfällt, aber ein Modell-Cache-Volume ist trotzdem der schnellste Weg, eine kleine Platte zu füllen. Steht lokale Inferenz irgendwo in Ihren Plänen, starten Sie bei 100 GB.
GPU
Nur für das vLLM-GPU-Profil erforderlich, das über den Compose-Block deploy.resources ein NVIDIA-Gerät reserviert und ohne dieses nicht startet. Standard-VPS-Pläne der unten genannten Anbieter enthalten keine GPU, weshalb praktisch nur ein entfernter OpenAI-kompatibler Endpunkt, das langsame CPU-Profil oder ein separater GPU-Host bleiben, den Jan Server anspricht.
Einstiegspläne der Anbieter im Vergleich zu diesen Anforderungen
| Anbieter | Einstiegsplan | RAM | CPU | Festplatte | Erreicht die 8-GB-Grenze? |
|---|---|---|---|---|---|
| Contabo | Cloud VPS 4 — 5,50 EUR/Monat zzgl. MwSt. | 8 GB | 4 vCPU | 100 GB SSD | Ja |
| Hetzner | CX23 — 5,49 EUR/Monat zzgl. MwSt. | 4 GB | 2 vCPU | 40 GB NVMe | Nein, Umstieg auf CX33 nötig |
| DigitalOcean | Basic Droplet — 6 USD/Monat | 1 GB | 1 vCPU | 25 GB SSD | Nein |
| Vultr | Cloud Compute — 5 USD/Monat | 1 GB | 1 vCPU | 25 GB SSD | Nein |
| Linode | Nanode — 5 USD/Monat | 1 GB | 1 vCPU | 25 GB SSD | Nein |
Nur ein Einstiegsplan aus dieser Liste erfüllt die Anforderung. Contabos günstigste Stufe hat seit der Umbenennung des Sortiments 8 GB, was bei diesem Preis ungewöhnlich ist und sie zur Standardempfehlung für Jan Server macht. Hetzner erreicht dieselben 8 GB mit CX33 für 8,49 EUR/Monat zzgl. MwSt., auf 80 GB NVMe statt 100 GB SATA-SSD.
Die US-Anbieter starten alle bei 1 GB, weshalb das Hosting von Jan Server dort bedeutet, mehrere Stufen aufzusteigen, statt den Einstiegsplan zu kaufen.
Dimensionierung im Überblick
| Konfiguration | RAM | vCPU | Festplatte |
|---|---|---|---|
| Einzelnutzer, entfernte Inferenz | 8 GB | 2 | 40 GB |
| Team-Nutzung, alle Dienste aktiviert | 12 GB | 4 | 80 GB |
| Lokale CPU-Inferenz, nur zum Testen | 12 GB+ | 4+ | 100 GB |
| Lokale GPU-Inferenz | je nach Modell | je nach Modell | 100 GB+ und eine NVIDIA-GPU |
Wählen Sie die Zeile, die zu Ihrer geplanten Art der Inferenz passt, und denken Sie daran, dass die 8-GB-Zahl ein dokumentiertes Minimum ist und kein komfortables Ziel. Aktuelle Pläne und Preise aller Anbieter finden Sie in unserem VPS-Vergleich.
Frequently asked questions
Wie viel RAM braucht Jan Server auf einem VPS mindestens?
Acht Gigabyte. Diese Zahl stammt aus dem eigenen README des Projekts, das für den vollständigen Satz an Diensten außerdem 12 GB empfiehlt. Sie deckt die Go-Microservices, Postgres, Keycloak und das Kong-Gateway ab und setzt voraus, dass die Inferenz woanders läuft als auf derselben Maschine.
Wie viel Festplattenspeicher sollte ich für Jan Server einplanen?
Starten Sie bei 40 GB, wenn Sie einen entfernten Inferenz-Endpunkt nutzen. Allein die Container-Images summieren sich über die Dienste, Postgres, Keycloak und Kong auf mehrere Gigabyte, und Postgres wächst danach mit dem Gesprächsverlauf. Aktivieren Sie die Media API mit lokalem Speicher oder cachen Sie Modellgewichte, verändert sich diese Zahl erheblich.
Braucht Jan Server eine NVIDIA-GPU?
Nur, wenn Sie die Inferenz lokal über das vLLM-GPU-Profil betreiben, das ein NVIDIA-Gerät reserviert und ohne dieses nicht startet. Zeigt Jan Server stattdessen auf einen entfernten OpenAI-kompatiblen Endpunkt, entfällt diese Anforderung komplett — das ist die übliche Konfiguration auf einem VPS.