Status und Verfügbarkeit
Gemessene Werte, keine Zusagen. Wir geben bewusst keinen SLA-Prozentsatz an: eine belegte Historie sagt mehr als ein Versprechen, das im Zweifel nicht zu halten ist.
| Komponente | Jetzt |
|---|---|
|
spark-1 + 2 (dgx-cluster)
vLLM · Qwen 3.5 397B
|
läuft |
|
spark-3
vLLM · Qwen 3.6 35B
|
läuft |
|
spark-4
Ollama · Modelle auf Abruf
|
läuft |
|
spark3_nemotron
|
läuft |
Letzte 30 Tage
Je Rechenknoten, alle fünf Minuten gemessen. Geplante Wartung zählt hier als Ausfall, wir rechnen sie nicht heraus.
| Knoten | Verfügbar | Messpunkte |
|---|---|---|
|
spark-1 + 2 (dgx-cluster)
vLLM · Qwen 3.5 397B, TP2 über beide Knoten
|
96,49 % | 8.831 |
|
spark-3
vLLM · Qwen 3.6 35B und Nemotron 3.5 Lightning
|
99,95 % | 8.863 |
|
spark-4
Ollama · alle bei Bedarf geladenen Modelle
|
99,86 % | 8.863 |
|
Plattform insgesamt
Mindestens ein Knoten einsatzbereit
|
100,00 % | 8.863 |
Die letzte Zeile ist die Zahl, die für Sie zählt: Fällt ein einzelner Knoten aus, übernimmt die Fallback-Kette und Ihre Anfrage wird trotzdem beantwortet, nur von einem anderen Modell.
Anfragen
Alle Kundenanfragen der letzten 30 Tage nach Ergebnis.
| Anfragen gesamt | 14.401 |
| Erfolgreich | 14.263 · 99,04 % |
| Fehler auf unserer Seite (5xx) | 129 · 0,90 % |
| Abgelehnt wegen fehlerhafter Anfrage (4xx) | 9 |
Die 5xx weisen wir mit aus. Sie stammen überwiegend aus Wartungsfenstern, in denen ein Modell neu aufgesetzt wurde.
Erhoben von einem eigenen Collector, der die Dienste alle fünf Minuten direkt auf den Knoten abfragt, und aus dem Anfrage-Log des Gateways. Beides läuft ununterbrochen seit 02.04.2026.