Seminar SCS Betrieb: Monitoring, Wartung und Troubleshooting

Seminarbeschreibung

Ein grüner Einzelstatus sagt wenig darüber aus, ob ein Cloud-Dienst für Anwendungen tatsächlich funktioniert. Das Seminar verbindet technische Zustandsüberwachung mit servicebezogenen Prüfungen. Ein vorbereiteter Monitoring-Stack mit Prometheus, Alertmanager und Grafana dient als Übungswerkzeug für die beteiligten Infrastrukturkomponenten.

Die Diagnose folgt einem wiederholbaren Ablauf: Auswirkung bestimmen, Beobachtungen sammeln, Hypothese prüfen und die Wirkung einer Maßnahme kontrollieren. Wartung, Sicherungen und Wiederanlauf werden in diesen Ablauf eingebunden. Neben der technischen Bearbeitung wird ein knappes, belastbares Betriebsprotokoll erstellt, das die nächste Schicht oder ein eskaliertes Fachteam übernehmen kann.

Seminarinhalte

Dienstsicht und Betriebsverantwortung

  • Infrastrukturzustand, API-Verfügbarkeit und nutzbare Anwendungsfunktion getrennt bewerten.
  • Serviceziele, Prüfpunkte und Zuständigkeiten für IaaS und KaaS festlegen.
  • Abhängigkeiten von DNS, Zeitdiensten, Zertifikaten und Identitätsdiensten in die Diagnose aufnehmen.

Metriken und Dashboards

  • Relevante Messwerte für Hosts, Compute, Storage, Netzwerk und Kubernetes im Labormonitoring zuordnen.
  • Kapazität, Fehlerrate, Latenz und Sättigung als unterschiedliche Beobachtungen nutzen.
  • Ein Grafana-Dashboard auf einen konkreten Störungsfall ausrichten und irreführende Einzelwerte erkennen.

Alarmierung und Serviceprüfungen

  • Prometheus-Regeln und Alertmanager-Zuordnung in der vorbereiteten Konfiguration nachvollziehen.
  • Schwellenwerte, Dauerbedingungen, Zusammenfassung und Wartungsunterdrückung begründet festlegen.
  • Einen Alarm mit Auswirkung, erstem Prüfschritt und notwendiger Eskalationsinformation versehen.

Protokolle und Fehlerkorrelation

  • Zeitstempel, Request-IDs und Dienstprotokolle zur Verbindung mehrerer Beobachtungen nutzen.
  • Berechtigungs-, Ressourcen-, Netzwerk- und Storage-Fehler mit einer Hypothesenliste eingrenzen.
  • Für die Fehlersuche erforderliche Daten mit möglichst geringen zusätzlichen Zugriffen erfassen.

Wartung und Wiederanlauf

  • Wartungsfenster, freie Kapazität und aktuelle Sicherungen vor einer Änderung prüfen.
  • Vorher-/Nachher-Tests und Abbruchkriterien für einen begrenzten Wartungsfall festlegen.
  • Wiederanlaufprüfungen für Cloud-APIs und einen Beispielworkload dokumentieren.

Störungsbearbeitung und Betriebsdokumentation

  • Eine Störung nach Dienstbeeinträchtigung priorisieren und geeignete Fachzuständigkeiten bestimmen.
  • Ein Runbook mit Beobachtung, Prüfschritten, erlaubten Maßnahmen und Eskalation erstellen.
  • Nach der Behebung Funktionsnachweise, verbleibende Risiken und Folgeaufgaben festhalten.

Praxisübungen

Überwachung verbessern

Ein vorbereitetes Dashboard auswerten, eine passende Alarmregel ergänzen, einen Testalarm auslösen und die Zustellung im Labor kontrollieren.

Störung bearbeiten

Eine fehlgeschlagene Cloud-Funktion reproduzieren, Metriken und Logs korrelieren, die Ursache eingrenzen, eine freigegebene Maßnahme durchführen und das Runbook vervollständigen.

Schulungsumgebung

Die Schulungsumgebung wird kundenseitig bereitgestellt. Benötigt werden eine vorbereitete Cloud, Prometheus, Alertmanager und Grafana, geeignete Dienstprotokolle sowie freigegebene Störungsszenarien in einer isolierten Testumgebung. Alarmempfänger werden ausschließlich als Testziele eingerichtet.

Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner

Dauer: 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr
Preis: Öffentlich oder Live Stream: € 1.198 zzgl. MwSt.
Inhaus: € 3.400 zzgl. MwSt.
Teilnehmeranzahl: min. 2 - max. 8
Teilnehmer: Cloud-Betriebsteams, Systemadministratoren, technische Supportteams und Mitarbeitende im Bereitschaftsdienst
Voraussetzungen: Praktische OpenStack-Administration, Linux-Kenntnisse und Grundverständnis von Kubernetes; Erfahrung mit Metriken und Protokollen hilfreich
Standorte: Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg
Methoden: Vortrag, Demonstrationen, praktische Übungen am System
Seminararten: Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht
Durchführungsgarantie: ja, ab 2 Teilnehmern
Sprache: Deutsch - bei Firmenseminaren ist auch Englisch möglich
Seminarunterlage: Dokumentation auf Datenträger oder als Download
Teilnahmezertifikat: ja, selbstverständlich
Verpflegung: Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch)
Support: 3 Anrufe im Seminarpreis enthalten
Barrierefreier Zugang: an den meisten Standorten verfügbar
  Weitere Informationen unter + 49 (221) 74740055

Seminartermine

Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.

Seminar Startdatum Enddatum Ort Dauer
Stream live 2 Tage
Stream gespeichert 2 Tage
Luzern 2 Tage
Bern 2 Tage
Inhaus / Firmenseminar 2 Tage
Sankt Gallen 2 Tage
Basel 2 Tage
Winterthur 2 Tage
Zürich 2 Tage
Zürich 2 Tage
Stream live 2 Tage
Stream gespeichert 2 Tage
Bern 2 Tage
Luzern 2 Tage
Inhaus / Firmenseminar 2 Tage
Sankt Gallen 2 Tage
Basel 2 Tage
Winterthur 2 Tage
Winterthur 2 Tage
Zürich 2 Tage
Stream live 2 Tage
Stream gespeichert 2 Tage
Luzern 2 Tage
Bern 2 Tage
Inhaus / Firmenseminar 2 Tage
Sankt Gallen 2 Tage
Basel 2 Tage
Basel 2 Tage
Winterthur 2 Tage
Zürich 2 Tage
Stream live 2 Tage
Stream gespeichert 2 Tage
Luzern 2 Tage
Bern 2 Tage
Inhaus / Firmenseminar 2 Tage
Sankt Gallen 2 Tage
Sankt Gallen 2 Tage
Basel 2 Tage
Winterthur 2 Tage
Zürich 2 Tage
Nach oben
Seminare als Stream SRI zertifiziert
© 2026 www.seminar-experts.ch All rights reserved.  | Kontakt | Impressum | Cookie-Einstellungen | Nach oben