Seminarbeschreibung
Ein grüner Einzelstatus sagt wenig darüber aus, ob ein Cloud-Dienst für Anwendungen tatsächlich funktioniert. Das Seminar verbindet technische Zustandsüberwachung mit servicebezogenen Prüfungen. Ein vorbereiteter Monitoring-Stack mit Prometheus, Alertmanager und Grafana dient als Übungswerkzeug für die beteiligten Infrastrukturkomponenten.
Die Diagnose folgt einem wiederholbaren Ablauf: Auswirkung bestimmen, Beobachtungen sammeln, Hypothese prüfen und die Wirkung einer Maßnahme kontrollieren. Wartung, Sicherungen und Wiederanlauf werden in diesen Ablauf eingebunden. Neben der technischen Bearbeitung wird ein knappes, belastbares Betriebsprotokoll erstellt, das die nächste Schicht oder ein eskaliertes Fachteam übernehmen kann.
Seminarinhalte
Dienstsicht und Betriebsverantwortung
- Infrastrukturzustand, API-Verfügbarkeit und nutzbare Anwendungsfunktion getrennt bewerten.
- Serviceziele, Prüfpunkte und Zuständigkeiten für IaaS und KaaS festlegen.
- Abhängigkeiten von DNS, Zeitdiensten, Zertifikaten und Identitätsdiensten in die Diagnose aufnehmen.
Metriken und Dashboards
- Relevante Messwerte für Hosts, Compute, Storage, Netzwerk und Kubernetes im Labormonitoring zuordnen.
- Kapazität, Fehlerrate, Latenz und Sättigung als unterschiedliche Beobachtungen nutzen.
- Ein Grafana-Dashboard auf einen konkreten Störungsfall ausrichten und irreführende Einzelwerte erkennen.
Alarmierung und Serviceprüfungen
- Prometheus-Regeln und Alertmanager-Zuordnung in der vorbereiteten Konfiguration nachvollziehen.
- Schwellenwerte, Dauerbedingungen, Zusammenfassung und Wartungsunterdrückung begründet festlegen.
- Einen Alarm mit Auswirkung, erstem Prüfschritt und notwendiger Eskalationsinformation versehen.
Protokolle und Fehlerkorrelation
- Zeitstempel, Request-IDs und Dienstprotokolle zur Verbindung mehrerer Beobachtungen nutzen.
- Berechtigungs-, Ressourcen-, Netzwerk- und Storage-Fehler mit einer Hypothesenliste eingrenzen.
- Für die Fehlersuche erforderliche Daten mit möglichst geringen zusätzlichen Zugriffen erfassen.
Wartung und Wiederanlauf
- Wartungsfenster, freie Kapazität und aktuelle Sicherungen vor einer Änderung prüfen.
- Vorher-/Nachher-Tests und Abbruchkriterien für einen begrenzten Wartungsfall festlegen.
- Wiederanlaufprüfungen für Cloud-APIs und einen Beispielworkload dokumentieren.
Störungsbearbeitung und Betriebsdokumentation
- Eine Störung nach Dienstbeeinträchtigung priorisieren und geeignete Fachzuständigkeiten bestimmen.
- Ein Runbook mit Beobachtung, Prüfschritten, erlaubten Maßnahmen und Eskalation erstellen.
- Nach der Behebung Funktionsnachweise, verbleibende Risiken und Folgeaufgaben festhalten.
Praxisübungen
Überwachung verbessern
Ein vorbereitetes Dashboard auswerten, eine passende Alarmregel ergänzen, einen Testalarm auslösen und die Zustellung im Labor kontrollieren.
Störung bearbeiten
Eine fehlgeschlagene Cloud-Funktion reproduzieren, Metriken und Logs korrelieren, die Ursache eingrenzen, eine freigegebene Maßnahme durchführen und das Runbook vervollständigen.
Schulungsumgebung
Die Schulungsumgebung wird kundenseitig bereitgestellt. Benötigt werden eine vorbereitete Cloud, Prometheus, Alertmanager und Grafana, geeignete Dienstprotokolle sowie freigegebene Störungsszenarien in einer isolierten Testumgebung. Alarmempfänger werden ausschließlich als Testziele eingerichtet.
Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
|---|---|
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Cloud-Betriebsteams, Systemadministratoren, technische Supportteams und Mitarbeitende im Bereitschaftsdienst |
| Voraussetzungen: | Praktische OpenStack-Administration, Linux-Kenntnisse und Grundverständnis von Kubernetes; Erfahrung mit Metriken und Protokollen hilfreich |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
