Seminar / Training
Herkunft und Verarbeitung eines Datensatzes müssen technisch recherchierbar und organisatorisch bewertbar sein. Provenance-Funktionen werden deshalb mit Schutzbedarf, Rollen, Dokumentation und Freigaben verbunden.
Inhaltsübersicht
- Einordnung und Zielsetzung
- Zielgruppe und Voraussetzungen
- Lernziele
- Provenance-Grundmodell
- Suche und Lineage
- Content-Zugriff und Replay
- Aufbewahrung und Repository-Planung
- Klassifizierung und Schutzbedarf
- Governance und Audit
- Praxisübungen
- Anwendungsszenarien
Einordnung und Zielsetzung
Zwei Tage sind erforderlich, um Suche, Lineage und Replay praktisch zu beherrschen und daraus ein belastbares Governance- und Auditverfahren zu entwickeln.
Zielgruppe
Datenmanagement, Governance, Revision, Datenschutz, Informationssicherheit, NiFi-Administration und Architektur.
Voraussetzungen
NiFi-Grundkenntnisse sowie Verständnis von Datenklassifizierung, Aufbewahrung und Berechtigungskonzepten.
Lernziele
- Provenance-Ereignisse interpretieren.
- Lineage vorwärts und rückwärts verfolgen.
- Replay kontrolliert einsetzen.
- Aufbewahrung und Kapazität planen.
- Schutzbedürftige Attribute behandeln.
- Governance- und Auditnachweise strukturieren.
Seminarinhalte
1. Provenance-Grundmodell
Ereignisse beschreiben Empfang, Transformation, Verbindung, Versand und Verwerfen.
- Schritt 1: FlowFile-UUID und Eltern-Kind-Beziehung erklären.
- Schritt 2: Ereignistypen einem Beispielprozess zuordnen.
- Schritt 3: Attribute, Content und Zeitstempel unterscheiden.
- Schritt 4: Grenzen zu Logs und fachlichem Audit festhalten.
- Schritt 5: Recherchefragen formulieren.
2. Suche und Lineage
Eine strukturierte Suche reduziert Ereignismengen auf einen überprüfbaren Datenweg.
- Schritt 1: Zeitfenster und Prozessgruppe eingrenzen.
- Schritt 2: Nach Attribut, Typ oder Komponenten-ID filtern.
- Schritt 3: Ereignisdetails vergleichen.
- Schritt 4: Lineage in beide Richtungen öffnen.
- Schritt 5: Rechercheergebnis dokumentieren.
3. Content-Zugriff und Replay
Inhaltszugriff und Wiederholung benötigen besondere Rechte und einen kontrollierten Zweck.
- Schritt 1: Berechtigungen für Provenance und Content prüfen.
- Schritt 2: Content-Verfügbarkeit aus Aufbewahrung ableiten.
- Schritt 3: Replay-Auswirkung vorab kontrollieren.
- Schritt 4: Testereignis in sicheren Pfad wiederholen.
- Schritt 5: Ergebnis als Auditvorgang protokollieren.
4. Aufbewahrung und Repository-Planung
Aufbewahrungsdauer, Ereignisrate und Suchbedarf bestimmen die Kapazität.
- Schritt 1: Ereignisrate und mittlere Größe abschätzen.
- Schritt 2: Zeit- und Größengrenzen festlegen.
- Schritt 3: Archivierung und Löschung bewerten.
- Schritt 4: Warnschwellen definieren.
- Schritt 5: Auswirkung verkürzter Aufbewahrung dokumentieren.
5. Klassifizierung und Schutzbedarf
Auch Attribute und Metadaten können schützenswerte Informationen enthalten.
- Schritt 1: Sensitive Attribute identifizieren.
- Schritt 2: Notwendigkeit einzelner Metadaten prüfen.
- Schritt 3: Maskierung oder Minimierung festlegen.
- Schritt 4: Zugriff auf Flow, Provenance und Content abstufen.
- Schritt 5: Restricted Components und Datenwege bewerten.
6. Governance und Audit
Rollen, Namensregeln, Pflichtdokumentation und Freigaben machen technische Funktionen wirksam.
- Schritt 1: Verantwortliche für Flow, Datenobjekt und Plattform benennen.
- Schritt 2: Namensstandard für Prozessgruppen definieren.
- Schritt 3: Pflichtangaben zu Zweck, Version und Datenklasse festlegen.
- Schritt 4: Änderung mit Review und Abnahme verknüpfen.
- Schritt 5: Regelmäßige Governance-Prüfung planen.
Praxisübungen
- Lineage eines FlowFiles rekonstruieren.
- Replay unter kontrollierten Rechten durchführen.
- Aufbewahrung dimensionieren.
- Sensitive Attribute minimieren.
- Governance-Checkliste erstellen.
Anwendungsszenarien
- Auditierbare Datenintegration
- Fehler- und Vorfallanalyse
- Nachweis von Datenherkunft
- Regulierte Flow-Freigabe
Fachbereichsleitung / Leitung der Trainer / Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de
Seminardetails
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, 2. Tag: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Datenmanagement, Governance, Revision, Datenschutz, Informationssicherheit, NiFi-Administration und Architektur. |
| Voraussetzungen: | NiFi-Grundkenntnisse sowie Verständnis von Datenklassifizierung, Aufbewahrung und Berechtigungskonzepten. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhouse, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
