Status und Verfügbarkeit

Gemessene Werte, keine Zusagen. Wir geben bewusst keinen SLA-Prozentsatz an: eine belegte Historie sagt mehr als ein Versprechen, das im Zweifel nicht zu halten ist.

Komponente Jetzt
spark-1 + 2 (dgx-cluster)
vLLM · Qwen 3.5 397B
läuft
spark-3
vLLM · Qwen 3.6 35B
läuft
spark-4
Ollama · Modelle auf Abruf
läuft
spark3_nemotron
läuft

Letzte 30 Tage

Je Rechenknoten, alle fünf Minuten gemessen. Geplante Wartung zählt hier als Ausfall, wir rechnen sie nicht heraus.

Knoten Verfügbar Messpunkte
spark-1 + 2 (dgx-cluster)
vLLM · Qwen 3.5 397B, TP2 über beide Knoten
96,49 % 8.831
spark-3
vLLM · Qwen 3.6 35B und Nemotron 3.5 Lightning
99,95 % 8.863
spark-4
Ollama · alle bei Bedarf geladenen Modelle
99,86 % 8.863
Plattform insgesamt
Mindestens ein Knoten einsatzbereit
100,00 % 8.863
Die letzte Zeile ist die Zahl, die für Sie zählt: Fällt ein einzelner Knoten aus, übernimmt die Fallback-Kette und Ihre Anfrage wird trotzdem beantwortet, nur von einem anderen Modell.

Anfragen

Alle Kundenanfragen der letzten 30 Tage nach Ergebnis.

Anfragen gesamt 14.401
Erfolgreich 14.263 · 99,04 %
Fehler auf unserer Seite (5xx) 129 · 0,90 %
Abgelehnt wegen fehlerhafter Anfrage (4xx) 9
Die 5xx weisen wir mit aus. Sie stammen überwiegend aus Wartungsfenstern, in denen ein Modell neu aufgesetzt wurde.

Erhoben von einem eigenen Collector, der die Dienste alle fünf Minuten direkt auf den Knoten abfragt, und aus dem Anfrage-Log des Gateways. Beides läuft ununterbrochen seit 02.04.2026.