Seminar / Training
Das Intensivformat fasst alle fachlich und integrationsorientierten Einzelseminare zusammen. Ein Datenfluss wird von der Quelle über Validierung, Transformation und Verteilung bis zum Audit- und Wiederanlaufnachweis aufgebaut.
Inhaltsübersicht
- Einordnung und Zielsetzung
- Zielgruppe und Voraussetzungen
- Lernziele
- Tag 1: Grundlagen und Flow-Design
- Tag 2: Expression Language, Records und Qualität
- Tag 3: Datenbanken und CDC
- Tag 4: Kafka, MQTT und verteilte Flows
- Tag 5: Governance und Stateless
- Querschnitt: Datenvertrag und Betriebsübergabe
- Praxisübungen
- Anwendungsszenarien
Einordnung und Zielsetzung
Fünf Tage sind die notwendige Höchstdauer, um mehrere Quell- und Zielklassen, Record-Verarbeitung, Governance und Fehlersemantik in einer konsistenten Ende-zu-Ende-Lösung praktisch abzudecken.
Zielgruppe
Data Engineering, Integrationsentwicklung, Datenarchitektur, Plattform-Engineering, Data Governance und technische Key-User.
Voraussetzungen
Grundlagen zu Datenformaten, SQL, APIs und Messaging; erste NiFi-Bedienkenntnisse sind hilfreich.
Lernziele
- Wartbare NiFi-Flows mit klaren Verträgen entwerfen.
- Expression Language und RecordPath sicher anwenden.
- Datenbanken und CDC robust integrieren.
- Kafka, MQTT und Messaging anbinden.
- Datenqualität und Fehlerpfade standardisieren.
- Provenance, Governance, Site-to-Site und Stateless-Ausführung einsetzen.
Seminarinhalte
1. Tag 1: Grundlagen und Flow-Design
Architektur, Oberfläche, Prozessgruppen, Queues, Back Pressure und einheitliche Designregeln bilden das Fundament.
- Schritt 1: Ersten Flow erstellen und beobachten.
- Schritt 2: Prozessgruppen und Ports strukturieren.
- Schritt 3: Naming und Dokumentation anwenden.
- Schritt 4: Back Pressure und Priorisierung setzen.
- Schritt 5: Provenance für den Basisflow auswerten.
2. Tag 2: Expression Language, Records und Qualität
Dynamisches Routing und schemaorientierte Verarbeitung werden mit Validierungs- und Fehlerregeln verbunden.
- Schritt 1: Attribute und Funktionen einsetzen.
- Schritt 2: Record Reader und Writer konfigurieren.
- Schritt 3: RecordPath für Auswahl und Transformation nutzen.
- Schritt 4: Schema- und Fachregeln validieren.
- Schritt 5: Retry-, Quarantäne- und Dead-Letter-Pfade testen.
3. Tag 3: Datenbanken und CDC
Inkrementelle Extraktion, zustandsbasierte Fortschrittskontrolle und idempotentes Laden werden praktisch umgesetzt.
- Schritt 1: JDBC-Pool und SQL-Zugriff konfigurieren.
- Schritt 2: Inkrementelle Abfrage mit State erstellen.
- Schritt 3: CDC-Ereignisse normalisieren.
- Schritt 4: Transaktion und Idempotenz absichern.
- Schritt 5: Reconciliation zwischen Quelle und Ziel durchführen.
4. Tag 4: Kafka, MQTT und verteilte Flows
Event Streaming und Site-to-Site werden mit Schema, Sicherheit, Lastverteilung und Ausfallverhalten verbunden.
- Schritt 1: Kafka konsumieren und produzieren.
- Schritt 2: Keys, Header und Consumer Groups behandeln.
- Schritt 3: MQTT-Telemetrie erfassen.
- Schritt 4: Remote Process Group und Policies konfigurieren.
- Schritt 5: Broker- oder Zielausfall mit Back Pressure testen.
5. Tag 5: Governance und Stateless
Nachvollziehbarkeit, Aufbewahrung, Replay und zustandsarme Jobausführung schließen den Datenlebenszyklus ab.
- Schritt 1: Provenance- und Auditfragen definieren.
- Schritt 2: Retention und Zugriff begrenzen.
- Schritt 3: Replay und Reprocessing kontrollieren.
- Schritt 4: Flow auf Stateless-Eignung prüfen.
- Schritt 5: Transaktions-, Wiederholungs- und Abnahmenachweis erstellen.
6. Querschnitt: Datenvertrag und Betriebsübergabe
Schema, Semantik, Fehlercodes, Messwerte und Verantwortlichkeiten bleiben über alle Integrationsstufen konsistent.
- Schritt 1: Datenvertrag versionieren.
- Schritt 2: Qualitätskennzahlen festlegen.
- Schritt 3: Fehlerklassen standardisieren.
- Schritt 4: SLO und Alarmierung ergänzen.
- Schritt 5: Runbook und fachliche Abnahme finalisieren.
Praxisübungen
- Ende-zu-Ende-Flow mit Record-Verarbeitung erstellen.
- CDC-Daten idempotent laden.
- Kafka- und MQTT-Ereignisse normalisieren.
- Site-to-Site-Ausfall testen.
- Provenance-, Qualitäts- und Stateless-Nachweis erstellen.
Anwendungsszenarien
- Data Lake Ingestion
- Operational Data Integration
- Event-Streaming-Pipelines
- Governance- und Auditpflichtige Datenflüsse
Fachbereichsleitung / Leitung der Trainer / Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 5 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 2.995 zzgl. MwSt. Inhaus: € 8.500 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Data Engineering, Integrationsentwicklung, Datenarchitektur, Plattform-Engineering, Data Governance und technische Key-User. |
| Voraussetzungen: | Grundlagen zu Datenformaten, SQL, APIs und Messaging; erste NiFi-Bedienkenntnisse sind hilfreich. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhouse, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
