Zum Inhalt

Administration

Clusterzustand prüfen

Befehl Aktion
ceph status Aktuellen Clusterzustand anzeigen
ceph health detail Ursache von HEALTH_WARN/HEALTH_ERR anzeigen
ceph df Kapazität von Cluster und Pools anzeigen
ceph osd status Kompakte Übersicht über alle OSDs anzeigen
ceph osd tree OSDs nach Host/CRUSH-Hierarchie anzeigen, inkl. up/down und in/out
ceph osd df Auslastung einzelner OSDs anzeigen
ceph pg stat Zustand der Placement Groups zusammengefasst anzeigen
ceph mon stat Zustand und Quorum der MONs anzeigen

OSD und Node zuordnen

Befehl Aktion
kubectl -n rook-ceph get pods -l app=rook-ceph-osd -o wide OSD-Pods den Kubernetes-Nodes zuordnen
ceph osd metadata <OSD-ID> \| grep -E "devices\|device_paths" Gerätename/-pfad einer OSD ermitteln

Node-Wartung

Befehl Aktion
kubectl -n rook-ceph get cephcluster rook-ceph -o jsonpath='{.spec.disruptionManagement}' Automatische PDB-/noout-Verwaltung prüfen
kubectl -n rook-ceph get pdb Erzeugte PodDisruptionBudgets anzeigen
kubectl cordon <NODE> Node als nicht mehr schedulable markieren
kubectl drain <NODE> --ignore-daemonsets --delete-emptydir-data Verschiebbare Pods vom Node entfernen
kubectl uncordon <NODE> Node wieder schedulable machen
kubectl get node <NODE> Node-Status prüfen (Ready)