Das Seminar entwickelt eine durchgängige Observability- und SRE-Praxis für Infrastruktur, OpenStack-Dienste und Mandantenpfade.
Ziel ist ein signalorientiertes Überwachungssystem mit klaren Servicezielen, wirksamen Alarmen, korrelierbaren Protokollen und ausführbaren Runbooks.
Inhaltsübersicht
- Serviceziele und Messmodell
- Infrastrukturmetriken
- OpenStack-Serviceüberwachung
- Alarmdesign
- Zentrales Logging
- Dashboards und Lagebild
- Runbooks und Incident Response
- SRE-Weiterentwicklung
- Praxislabor und betriebliche Einordnung
Zielsetzung
Ziel ist ein signalorientiertes Überwachungssystem mit klaren Servicezielen, wirksamen Alarmen, korrelierbaren Protokollen und ausführbaren Runbooks. Die Arbeitsweise verbindet fachliche Einordnung, Demonstrationen und unmittelbar nachvollziehbare Übungen an einer praxisnahen Umgebung.
Zielgruppe
Cloud-Administratoren, SRE-Teams, Monitoring-Spezialisten und Betriebsverantwortliche.
Voraussetzungen
Linux-, Netzwerk- und OpenStack-Betriebserfahrung.
Seminarinhalte
Modul 1: Serviceziele und Messmodell
- Schritt 1: kritische Dienste und Nutzerpfade identifizieren.
- Schritt 2: SLIs, SLOs und Fehlerbudgets definieren.
- Schritt 3: Messlücken und Verantwortlichkeiten dokumentieren.
Modul 2: Infrastrukturmetriken
- Schritt 1: Host-, Netzwerk-, Storage- und Containerwerte auswählen.
- Schritt 2: Label und Aggregationen konsistent gestalten.
- Schritt 3: Baseline und Kapazitätsgrenzen bestimmen.
Modul 3: OpenStack-Serviceüberwachung
- Schritt 1: API, Scheduler, Datenbanken und Messaging überwachen.
- Schritt 2: synthetische End-to-End-Checks erstellen.
- Schritt 3: Dienststatus und Nutzerwirkung gemeinsam bewerten.
Modul 4: Alarmdesign
- Schritt 1: Symptome statt bloßer Ursachen priorisieren.
- Schritt 2: Schwellwerte, Zeitfenster und Unterdrückung festlegen.
- Schritt 3: Alarmketten mit Testereignissen verifizieren.
Modul 5: Zentrales Logging
- Schritt 1: Logquellen, Formate und Aufbewahrung standardisieren.
- Schritt 2: Request-IDs und Zeitbezug für Korrelation nutzen.
- Schritt 3: Suchmuster für häufige Fehlerbilder erstellen.
Modul 6: Dashboards und Lagebild
- Schritt 1: Zielgruppen und Entscheidungsfragen pro Dashboard festlegen.
- Schritt 2: Service-, Kapazitäts- und Fehleransichten trennen.
- Schritt 3: Darstellung auf Handlungsrelevanz prüfen.
Modul 7: Runbooks und Incident Response
- Schritt 1: Alarme mit Diagnoseschritten und Eskalation verknüpfen.
- Schritt 2: Incident-Kommunikation und Rollen festlegen.
- Schritt 3: Nachbereitung und Verbesserungsmaßnahmen standardisieren.
Modul 8: SRE-Weiterentwicklung
- Schritt 1: Toil und wiederkehrende Störungen messen.
- Schritt 2: Automatisierung nach Risiko und Wirkung priorisieren.
- Schritt 3: SLOs und Alarmqualität regelmäßig überprüfen.
Praxislabor
- Aufgabe 1: Definition eines SLO für einen Instanzbereitstellungspfad.
- Aufgabe 2: Aufbau eines Alarm- und Runbook-Sets.
- Aufgabe 3: Korrelation eines simulierten Fehlers über Metriken und Logs.
Praxisnutzen
Nach Abschluss können die behandelten Verfahren für Serviceziele und Messmodell, Infrastrukturmetriken, OpenStack-Serviceüberwachung, Alarmdesign strukturiert geplant, ausgeführt, geprüft und dokumentiert werden. Technische Entscheidungen lassen sich anhand definierter Anforderungen, Messwerte und kontrollierter Arbeitsschritte begründen.
Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Cloud-Administratoren, SRE-Teams, Monitoring-Spezialisten und Betriebsverantwortliche |
| Voraussetzungen: | Linux-, Netzwerk- und OpenStack-Betriebserfahrung |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, schrittweise praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Digitale Dokumentation als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
