Copyright © 2022-2026 basebox GmbH, all rights reserved.
Licensed to be used in conjunction with basebox, only.
Licensed to be used in conjunction with basebox, only.
// installation
basebox-Plattform
Gilt für
Produkt: Server · Zielgruppe: Platform Operator
Die Plattformschicht ist alles, was Nutzer oder Administratoren direkt berühren, plus die Dienste, die basebox zusammenhalten. Sie ist der Teil von basebox, der basebox ist – und bewusst GPU-arm.
Was zur Plattform gehört
| Komponente | Rolle |
|---|---|
| frontend | Die Web-Oberfläche |
| AISRV | Anwendungsserver: Chat-Orchestrierung, Apps, Konnektoren (MCP-Gateway), OpenAI-kompatible und REST-API |
| storesrv | Dokument- und Objektspeicherdienst |
| Keycloak (IDP) | Authentifizierung, Benutzer, Gruppen, LDAP/OIDC-Föderation |
| Datenbanken | PostgreSQL (CloudNativePG) für den Plattformzustand |
| Ingress / TLS | Eingangspunkt für Nutzer und API-Clients |
Die Konfiguration je Komponente ist unter Helm → Services dokumentiert; eine zusammengeführte Komponentenkarte steht unter basebox-Komponenten.
Ressourcenprofil
- CPU, RAM, Speicher, Netzwerk – dimensioniert nach Anzahl der Nutzer, Dokumente und API-Verkehr.
- GPU: keine erforderlich. Die Plattform kann auf einem reinen CPU-Anwendungsserver laufen. Teilt sie sich einen Knoten mit GPUs, verbraucht sie diese nicht.
Deshalb werden die GPUs einer Referenzkonfiguration immer den Service-Modellen und der Inferenz zugerechnet, nie der Plattform.
Wo sie laufen kann
- Auf demselben Knoten wie Service-Modelle und Inferenz (Einzelknoten-Referenzkonfigurationen)
- Auf einem separaten reinen CPU-Anwendungsserver, mit Inferenz auf einem dedizierten GPU-Host – siehe Deployment-Topologien
- In einem Kubernetes-Cluster mit gemischten CPU- und GPU-Knoten, in dem die Plattform auf CPU-Knoten geplant wird
Was die Plattform nicht ist
- Sie ist nicht das Modell. Ein Wechsel oder Upgrade des LLM ändert die Plattform nicht.
- Sie ist nicht die OCR-/STT-Engine. Das sind Service-Modelle.
- Sie ist nicht die Hardware-Anforderung. Aussagen wie „basebox braucht eine H200" beschreiben die Inferenz, nicht diese Schicht.
Nächster Schritt: Service-Modelle