Monitoring einer Infrastruktur bedeutet, ihren Betriebszustand kontinuierlich zu beobachten, um Anomalien zu erkennen, Ausfälle vorherzusehen und die Verfügbarkeit der Dienste zu verbessern.

Vorrangig zu überwachende Kennzahlen

  • CPU-Auslastung: nützlich, um länger anhaltende Sättigung zu erkennen
  • Arbeitsspeicher: hilft, Lecks oder Unterdimensionierung zu erkennen
  • Speicherplatz: entscheidend, um abrupte Unterbrechungen zu vermeiden
  • Dienste: Überprüfung des ordnungsgemäßen Zustands wesentlicher Anwendungen
  • Netzwerk: Latenz, Paketverlust, Verfügbarkeit

Ein sinnvolles Monitoring aufbauen

Gutes Monitoring sollte kein unnötiges Rauschen erzeugen. Ziel ist nicht ein mit Informationen gefülltes Dashboard, sondern wirklich verwertbare Warnmeldungen.

Beispiel für eine Alarmlogik

Eine sinnvolle Alarmlogik kombiniert mehrere Schwellenwerte, etwa CPU > 85 % für 10 Minuten, Systemlaufwerk > 90 %, einen ausgefallenen kritischen Dienst oder eine ungewöhnliche Antwortzeit einer Anwendung.

Eine betriebliche Sichtweise

Monitoring sollte eine einfache Frage beantworten: Was gefährdet die Dienstkontinuität wirklich? Diese Logik hilft, Kennzahlen zu priorisieren.

Monitoring bedeutet nicht, alles zu beobachten. Es bedeutet, das zu beobachten, was zählt — zur richtigen Zeit und mit dem richtigen Alarmniveau.

Fazit

Ein durchdachtes Monitoring verbessert die Reaktionsfähigkeit, reduziert Unterbrechungen und professionalisiert den Betrieb der Infrastruktur.