Zum Hauptinhalt springen

Monitoring & Observability

Die Bereitstellung wird mit einem schlanken, hochdichten Observability-Stack ausgeliefert, damit Ihr Betriebsteam volle Transparenz über sowohl die Plattform als auch die Anwendung hat.

Der Stack​

AnliegenWerkzeugRolle
Metrikenvmagent → VictoriaMetricsScrapt Performance-Endpunkte über Namespaces hinweg in einen verteilten Speicher (vmstorage, vminsert, vmselect).
LogsVector → VictoriaLogsSammelt stdout/stderr und leitet sie zur strukturierten Suche weiter.
DashboardsGrafanaVerbindet sich mit VictoriaMetrics und VictoriaLogs als Datenquellen.

Was überwacht werden soll​

  • Anwendungszustand — Anfragerate, Fehlerrate und Latenz des Cockpit-Frontends und des Rust-API-Backends.
  • OpenBao — Siegelstatus, Raft-Leadership und Anfragedurchsatz. Ein entsiegeltes, fehlerfreies Quorum ist kritisch.
  • PostgreSQL — Replikations-Lag, Verbindungen und Festplattenauslastung auf Primary und Replikaten.
  • Redis — Cluster-Zustand und Master-/Replikat-Failover-Ereignisse.
  • Plattform — Knoten-CPU/-Arbeitsspeicher, Pod-Neustarts und PersistentVolume-Kapazität.

Empfohlene Warnungen​

WarnungBedingung
OpenBao versiegeltEin beliebiger OpenBao-Knoten meldet sealed = true
PostgreSQL-Replikat-LagLag > 30 s über mehr als 5 Min.
Pod-Crash-LoopEin beliebiger DuoKey-Pod startet > 3 Mal in 10 Min. neu
Ingress 5xx5xx-Rate > 1 % über 5 Min.
PV fast vollEin beliebiges PersistentVolume > 85 % ausgelastet
Backup fehlgeschlagenGeplantes Velero-Backup wurde nicht erfolgreich abgeschlossen

Zugriff auf Dashboards​

Grafana wird über eine OpenShift-Route im Namespace duokey-observability bereitgestellt:

oc get route grafana -n duokey-observability

Importieren Sie die in Ihrem Auslieferungspaket enthaltenen DuoKey-Dashboards oder erstellen Sie Ihre eigenen auf Basis der Datenquellen VictoriaMetrics/VictoriaLogs.