Seminar / Training
Ein kompakter End-to-End-Einstieg verbindet Pipeline-Konfiguration, Synchronisationsmodi, Datenqualität, Betrieb, Sicherheit und grundlegende API-Automatisierung.
Die Schulung verbindet fachliche Einordnung, nachvollziehbare Konfiguration, systematische Prüfung und praktische Übungen an einer durchgängigen Arbeitsumgebung.
Inhaltsübersicht
- Zielsetzung
- Zielgruppe
- Voraussetzungen
- Seminarinhalte
- Praxisübungen
- Methodik
Zielsetzung
- Airbyte-Architektur und zentrale Objekte sicher einordnen
- Eine vollständige Pipeline mit passendem Modus und Zeitplan aufbauen
- Schema-, Qualitäts- und Wiederanlauffragen früh berücksichtigen
- Jobs, Logs und grundlegende Störungen systematisch bearbeiten
- Zugänge, Secrets und Datenumfang nach minimalem Bedarf steuern
- Einfache Verwaltungs- und Startvorgänge über die API automatisieren
Zielgruppe
Data Engineers, technische Key-User, Plattformadministratoren, Analytics Engineers und Projektteams, die in kurzer Zeit ein gemeinsames belastbares Arbeitsniveau benötigen.
Voraussetzungen
Grundverständnis von Datenbanken, APIs oder Dateidaten. Grundkenntnisse von Kommandozeile und Skripting sind für die Automatisierungsübungen hilfreich.
Seminarinhalte
Modul 1: Plattform, Begriffe und Einsatzgrenzen
Das gemeinsame Vokabular und die Verantwortung der Plattform werden anhand eines Datenflusses geklärt.
- Schritt 1: Quell-, Ziel- und Verbraucheranforderung erfassen
- Schritt 2: Connector, Quelle, Ziel, Verbindung, Stream und State zuordnen
- Schritt 3: Airbyte von Transformation und übergreifender Orchestrierung abgrenzen
- Schritt 4: Erfolgskriterien für das Praxisszenario festlegen
Modul 2: Quelle, Ziel und Verbindung
Eine erste Pipeline wird mit validierten Zugängen und klarer Zielstruktur aufgebaut.
- Schritt 1: Netzwerk, Rechte und Connector-Voraussetzungen prüfen
- Schritt 2: Quelle und Ziel konfigurieren sowie testen
- Schritt 3: Verbindung anlegen und Eigentümerschaft dokumentieren
- Schritt 4: Fehler aus Verbindungstests systematisch eingrenzen
Modul 3: Katalog, Sync Modes und Zeitplan
Datenumfang und Ausführungsverhalten werden aus fachlichem Bedarf abgeleitet.
- Schritt 1: Streams, Felder, Schlüssel und Cursor auswählen
- Schritt 2: Vollständige und inkrementelle Modi vergleichen
- Schritt 3: Zielverhalten, Namespace und Zeitplan festlegen
- Schritt 4: Konfiguration mit Testdaten und Grenzfällen prüfen
Modul 4: Schema, Qualität und Deduplizierung
Die Nutzbarkeit der Zieltabellen wird durch klare Struktur- und Qualitätsregeln abgesichert.
- Schritt 1: Kritische Datentypen und Pflichtfelder identifizieren
- Schritt 2: Primärschlüssel und Aktualitätsfeld für Deduplizierung prüfen
- Schritt 3: Schemaänderung und fehlerhaften Datensatz simulieren
- Schritt 4: Korrektur- und Nachladeverfahren dokumentieren
Modul 5: Betrieb, Logs und Wiederanlauf
Ein erfolgreicher erster Lauf wird in einen kontrollierten Betriebsablauf überführt.
- Schritt 1: Jobstatus, Versuch und Logkontext nachvollziehen
- Schritt 2: Fehler nach Authentifizierung, Netzwerk, Daten und Ressourcen klassifizieren
- Schritt 3: State und Wiederanlaufoption vor einer Wiederholung prüfen
- Schritt 4: Ergebnis mit Quell-Ziel-Stichproben freigeben
Modul 6: Sicherheit und Verantwortlichkeiten
Zugang und Datenumfang werden auf das erforderliche Maß begrenzt.
- Schritt 1: Technische Identitäten und minimale Rechte festlegen
- Schritt 2: Secrets außerhalb von Dokumentation und Code verwalten
- Schritt 3: Sensible Felder aus Katalog und Logs fernhalten
- Schritt 4: Eigentümer, Freigabe und regelmäßige Prüfung dokumentieren
Modul 7: API-Grundlagen und Automatisierung
Wiederkehrende Schritte werden mit einem sicheren Client nachvollziehbar automatisiert.
- Schritt 1: Technischen Zugriff einrichten und Authentifizierung testen
- Schritt 2: Ressourcen und Status über die API abfragen
- Schritt 3: Synchronisation auslösen und bis zum Endstatus überwachen
- Schritt 4: Fehler, Wiederholungen und Protokollierung sicher behandeln
Modul 8: Durchgängiges Praxisszenario
Konfiguration, Betrieb und Automatisierung werden in einer gemeinsamen Abnahme verbunden.
- Schritt 1: Pipeline aus bereitgestellter Anforderung eigenständig planen
- Schritt 2: Einrichten, testen und ersten Lauf ausführen
- Schritt 3: Schema- oder Zugangsstörung erkennen und kontrolliert beheben
- Schritt 4: Automatisierten Start, Datenprüfung und Betriebsübergabe durchführen
Praxisübungen
- Planung und Aufbau einer vollständigen Airbyte-Pipeline mit dokumentierter Zielstruktur
- Auswahl und Test eines inkrementellen Modus einschließlich Cursor und Wiederanlauf
- Bearbeitung eines Schema- und Qualitätsfehlers mit gezielter Nachladung
- Logbasierte Diagnose einer fehlgeschlagenen Synchronisation
- Automatisierter Start und Statusabruf über einen sicheren API-Client
- Abschlussübung mit Freigabecheckliste und Betriebsübergabe
Methodik
Kurze fachliche Einführungen wechseln mit Demonstrationen, geführten Konfigurationsschritten, eigenständigen Übungen, Fehleranalysen und dokumentierten Abnahmekontrollen. Ergebnisse werden anhand technischer Prüfpunkte und fachlicher Stichproben bewertet.
Fachbereichsleitung / Leitung der Trainer / Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Data Engineers, technische Key-User, Plattformadministratoren, Analytics Engineers und Projektteams, die in kurzer Zeit ein gemeinsames belastbares Arbeitsniveau benötigen. |
| Voraussetzungen: | Grundverständnis von Datenbanken, APIs oder Dateidaten. Grundkenntnisse von Kommandozeile und Skripting sind für die Automatisierungsübungen hilfreich. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
