Das Seminar vermittelt eine systematische Störungsanalyse und Wiederherstellung für Control Plane, Netzwerk, Storage und Compute einer StackHPC Private Cloud.
Ziel ist ein priorisiertes Vorgehen, das Symptome reproduzierbar eingrenzt, riskante Eingriffe vermeidet und Wiederanlauf sowie Datenkonsistenz nachweist.
Inhaltsübersicht
- Diagnosemodell und Lagebild
- Werkzeuge und Beweissicherung
- Control-Plane-Störungen
- Netzwerkstörungen
- Storage- und Volumeprobleme
- Compute- und Instanzprobleme
- Disaster-Recovery-Planung
- Wiederanlauf und Nachkontrolle
- Praxislabor und betriebliche Einordnung
Zielsetzung
Ziel ist ein priorisiertes Vorgehen, das Symptome reproduzierbar eingrenzt, riskante Eingriffe vermeidet und Wiederanlauf sowie Datenkonsistenz nachweist. Die Arbeitsweise verbindet fachliche Einordnung, Demonstrationen und unmittelbar nachvollziehbare Übungen an einer praxisnahen Umgebung.
Zielgruppe
Erfahrene OpenStack-Administratoren, SRE-Teams, Supportingenieure und Betriebsverantwortliche.
Voraussetzungen
Praktische OpenStack-, Linux-, Netzwerk- und Storage-Erfahrung.
Seminarinhalte
Modul 1: Diagnosemodell und Lagebild
- Schritt 1: Nutzerwirkung, Zeitachse und letzte Änderungen erfassen.
- Schritt 2: Fehlerdomäne und betroffene Pfade eingrenzen.
- Schritt 3: Hypothesen nach Risiko und Prüfbarkeit priorisieren.
Modul 2: Werkzeuge und Beweissicherung
- Schritt 1: Dienstzustände, Logs, Metriken und Konfigurationen sichern.
- Schritt 2: Request-IDs und Zeitstempel korrelieren.
- Schritt 3: Diagnoseänderungen nachvollziehbar dokumentieren.
Modul 3: Control-Plane-Störungen
- Schritt 1: API-, Datenbank-, Messaging- und Schedulerfehler unterscheiden.
- Schritt 2: Quorum und interne Erreichbarkeit prüfen.
- Schritt 3: Dienste in definierter Reihenfolge stabilisieren.
Modul 4: Netzwerkstörungen
- Schritt 1: Neutron-, OVN- und Linux-Zustände vergleichen.
- Schritt 2: Paketpfade und Portbindungen untersuchen.
- Schritt 3: Konnektivität ohne unnötige Eingriffe wiederherstellen.
Modul 5: Storage- und Volumeprobleme
- Schritt 1: Ceph-Health, Full Ratios und OSD-Zustände bewerten.
- Schritt 2: Cinder- und RBD-Zustände korrelieren.
- Schritt 3: Datenpfad und Volumezugriff sicher wiederherstellen.
Modul 6: Compute- und Instanzprobleme
- Schritt 1: Nova-, Placement- und Hypervisorzustände prüfen.
- Schritt 2: hängende Builds, Migrationen und Evakuierungen untersuchen.
- Schritt 3: Instanzen risikobewusst wieder verfügbar machen.
Modul 7: Disaster-Recovery-Planung
- Schritt 1: kritische Daten und Wiederherstellungsreihenfolgen festlegen.
- Schritt 2: RPO, RTO und Abhängigkeiten realistisch bestimmen.
- Schritt 3: Sicherungen und Notfallzugänge regelmäßig testen.
Modul 8: Wiederanlauf und Nachkontrolle
- Schritt 1: Dienste und Daten in kontrollierter Reihenfolge aktivieren.
- Schritt 2: End-to-End-Tests und Konsistenzprüfungen ausführen.
- Schritt 3: Ursache, Maßnahmen und Prävention dokumentieren.
Praxislabor
- Aufgabe 1: Bearbeitung einer mehrschichtigen Control-Plane-Störung.
- Aufgabe 2: Analyse eines kombinierten Netzwerk- und Volumefehlers.
- Aufgabe 3: Durchführung eines dokumentierten Teil-Wiederanlaufs.
Praxisnutzen
Nach Abschluss können die behandelten Verfahren für Diagnosemodell und Lagebild, Werkzeuge und Beweissicherung, Control-Plane-Störungen, Netzwerkstörungen strukturiert geplant, ausgeführt, geprüft und dokumentiert werden. Technische Entscheidungen lassen sich anhand definierter Anforderungen, Messwerte und kontrollierter Arbeitsschritte begründen.
Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Erfahrene OpenStack-Administratoren, SRE-Teams, Supportingenieure und Betriebsverantwortliche |
| Voraussetzungen: | Praktische OpenStack-, Linux-, Netzwerk- und Storage-Erfahrung |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, schrittweise praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Digitale Dokumentation als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
