Überblick
Ab Version 26.2 können Administratoren den koordinierten Neustart des gesamten Clusters selbst auslösen. Der Aufruf ist sowohl über die Seite System, DMZ, Loadbalancing als auch über die REST-API möglich.
Klickpfad
Navigieren Sie zu Verwaltung > Basis-Einstellungen > System, DMZ, Loadbalancing.
Funktionsweise
Beim Auslösen eines Neustarts geschieht Folgendes:
Das System nimmt sofort keine neuen Jobs mehr an.
Laufende Jobs erhalten eine konfigurierbare Karenzzeit. Default: 1 Minute.
Nach Ablauf der Karenzzeit wird der Neustart erzwungen. Noch laufende Jobs werden beendet.
Die Cluster-Komponenten werden in einer festgelegten Reihenfolge neu gestartet.
Neustart-Reihenfolge
Die Reihenfolge hängt von Ihrer Cluster-Topologie ab. Das System erkennt die Konfiguration automatisch.
Ohne Load-Balancer, ohne DMZ
Der Node Controller wird nach Ablauf der Karenzzeit direkt neu gestartet.
Ohne Load-Balancer, eine DMZ
Primary DMZ neu starten und auf Verfügbarkeit warten.
Node Controller neu starten.
Ohne Load-Balancer, mehrere DMZs
Alle Secondary DMZs parallel neu starten.
Warten, bis mindestens eine Secondary DMZ verfügbar ist.
Primary DMZ neu starten.
Node Controller neu starten.
Mit Load-Balancer und DMZs
DMZs: Secondary DMZs neu starten → mindestens eine muss verfügbar werden → Primary DMZ neu starten.
Worker Nodes: Aufteilung in zwei Gruppen. Erste Gruppe neu starten → mindestens ein Node muss verfügbar werden → zweite Gruppe neu starten.
Node Controller: Wird nur neu gestartet, wenn mehr als die Hälfte (
ceil(N/2)) aller Worker Nodes verfügbar ist.
Die aktive DMZ wird immer als letzte DMZ neu gestartet.
Mit Load-Balancer, ohne DMZs
Wie oben, beginnend mit den Worker Nodes.
Abbruchverhalten
Der Neustart wird abgebrochen, wenn eine Komponente nicht innerhalb des Zeitfensters wieder verfügbar wird. Nachfolgende Komponenten werden dann nicht neu gestartet.
Ausnahme: Wird die Primary DMZ nicht verfügbar, übernimmt eine Secondary DMZ deren Rolle. Der Neustart wird fortgesetzt.