Das zweitägige Seminar vermittelt einen kontrollierten Weg von heterogenen Quelldaten zu konsistenten Wissensgraphen und Vokabularen. Datenprofiling, Zielmodell, RDF-Ladevorgänge, templatebasierter Excel-Import, Mapping, inkrementelle Aktualisierung und Qualitätsabnahme werden als wiederholbare Importstrecke umgesetzt.
Inhaltsübersicht
- Lernziele und fachliche Einordnung
- Schrittweise Seminarinhalte
- Praxisübungen und Laborszenarien
- Zielgruppe und Voraussetzungen
- Didaktik und Arbeitsweise
Lernziele
- Quellen, Datenqualität, Identifikatoren und Änderungsmechanismen systematisch bewerten.
- Ein Zielmodell und belastbare Transformationsregeln für den Import festlegen.
- RDF-Daten und strukturierte Terminologiesammlungen kontrolliert laden.
- Excel-basierte Vokabularimporte reproduzierbar vorbereiten und prüfen.
- Inkrementelle Läufe, Fehlerbehandlung, Nachweise und Rollback operationalisieren.
Schrittweise Seminarinhalte
1. Quellenanalyse und Importanforderungen
Schwerpunkt: Dateiformate, Schemas, Schlüssel, Datenvolumen, Zeichensätze, Dubletten, Änderungsfrequenz, Datenschutz und Abnahmekriterien.
- Ausgangslage, fachliche Anforderungen und messbare Akzeptanzkriterien für den Themenblock „Quellenanalyse und Importanforderungen“ erfassen.
- Relevante Ressourcen, Rollen, Datenobjekte und Abhängigkeiten anhand von Dateiformate, Schemas, Schlüssel, Datenvolumen, Zeichensätze, Dubletten, Änderungsfrequenz, Datenschutz und Abnahmekriterien modellieren.
- Die erforderliche Konfiguration oder Arbeitsfolge in der metaphactory-Laborumgebung beziehungsweise im Prozessmodell schrittweise umsetzen.
- Funktion, Berechtigungen, Datenqualität, Protokollierung und Fehlerverhalten mit definierten Positiv- und Negativfällen prüfen.
- Als Arbeitsergebnis einen fachlich geprüften und wiederholbaren Standard für „Quellenanalyse und Importanforderungen“ dokumentieren.
2. Zielmodell, Identifikatoren und Mappingregeln
Schwerpunkt: IRIs, Klassen, Eigenschaften, Datentypen, Referenzen, Normalisierung, Provenienz, Standardwerte und Konfliktregeln.
- Ausgangslage, fachliche Anforderungen und messbare Akzeptanzkriterien für den Themenblock „Zielmodell, Identifikatoren und Mappingregeln“ erfassen.
- Relevante Ressourcen, Rollen, Datenobjekte und Abhängigkeiten anhand von IRIs, Klassen, Eigenschaften, Datentypen, Referenzen, Normalisierung, Provenienz, Standardwerte und Konfliktregeln modellieren.
- Die erforderliche Konfiguration oder Arbeitsfolge in der metaphactory-Laborumgebung beziehungsweise im Prozessmodell schrittweise umsetzen.
- Funktion, Berechtigungen, Datenqualität, Protokollierung und Fehlerverhalten mit definierten Positiv- und Negativfällen prüfen.
- Als Arbeitsergebnis einen fachlich geprüften und wiederholbaren Standard für „Zielmodell, Identifikatoren und Mappingregeln“ dokumentieren.
3. RDF-Laden und technische Importwege
Schwerpunkt: Dateiupload, Graphzuordnung, Bulk-Loading, Transaktionsgrenzen, Fehlerberichte, Wiederholung und Repository-spezifische Verfahren.
- Ausgangslage, fachliche Anforderungen und messbare Akzeptanzkriterien für den Themenblock „RDF-Laden und technische Importwege“ erfassen.
- Relevante Ressourcen, Rollen, Datenobjekte und Abhängigkeiten anhand von Dateiupload, Graphzuordnung, Bulk-Loading, Transaktionsgrenzen, Fehlerberichte, Wiederholung und Repository-spezifische Verfahren modellieren.
- Die erforderliche Konfiguration oder Arbeitsfolge in der metaphactory-Laborumgebung beziehungsweise im Prozessmodell schrittweise umsetzen.
- Funktion, Berechtigungen, Datenqualität, Protokollierung und Fehlerverhalten mit definierten Positiv- und Negativfällen prüfen.
- Als Arbeitsergebnis einen fachlich geprüften und wiederholbaren Standard für „RDF-Laden und technische Importwege“ dokumentieren.
4. Templatebasierter Excel-Import für Vokabulare
Schwerpunkt: Spaltenstruktur, Terminologievorlagen, Hierarchien, Labels, Notationen, redaktionelle Felder, Validierung und Wiederholbarkeit.
- Ausgangslage, fachliche Anforderungen und messbare Akzeptanzkriterien für den Themenblock „Templatebasierter Excel-Import für Vokabulare“ erfassen.
- Relevante Ressourcen, Rollen, Datenobjekte und Abhängigkeiten anhand von Spaltenstruktur, Terminologievorlagen, Hierarchien, Labels, Notationen, redaktionelle Felder, Validierung und Wiederholbarkeit modellieren.
- Die erforderliche Konfiguration oder Arbeitsfolge in der metaphactory-Laborumgebung beziehungsweise im Prozessmodell schrittweise umsetzen.
- Funktion, Berechtigungen, Datenqualität, Protokollierung und Fehlerverhalten mit definierten Positiv- und Negativfällen prüfen.
- Als Arbeitsergebnis einen fachlich geprüften und wiederholbaren Standard für „Templatebasierter Excel-Import für Vokabulare“ dokumentieren.
5. Inkrementelle Aktualisierung und Importabnahme
Schwerpunkt: Deltaerkennung, Merge, Löschregeln, Dublettenprüfung, SHACL-Validierung, Kennzahlen, Rollback und Laufprotokoll.
- Ausgangslage, fachliche Anforderungen und messbare Akzeptanzkriterien für den Themenblock „Inkrementelle Aktualisierung und Importabnahme“ erfassen.
- Relevante Ressourcen, Rollen, Datenobjekte und Abhängigkeiten anhand von Deltaerkennung, Merge, Löschregeln, Dublettenprüfung, SHACL-Validierung, Kennzahlen, Rollback und Laufprotokoll modellieren.
- Die erforderliche Konfiguration oder Arbeitsfolge in der metaphactory-Laborumgebung beziehungsweise im Prozessmodell schrittweise umsetzen.
- Funktion, Berechtigungen, Datenqualität, Protokollierung und Fehlerverhalten mit definierten Positiv- und Negativfällen prüfen.
- Als Arbeitsergebnis einen fachlich geprüften und wiederholbaren Standard für „Inkrementelle Aktualisierung und Importabnahme“ dokumentieren.
Praxisübungen und Laborszenarien
- Profiling einer Beispielquelle und Ableitung eines Zielmodells mit IRI- und Mappingregeln.
- Import einer vorbereiteten Terminologiesammlung aus Excel mit Validierungs- und Korrekturlauf.
- Durchführung eines inkrementellen Imports mit Dublettenprüfung und dokumentiertem Rollback.
Zielgruppe und Voraussetzungen
Zielgruppe: Data Engineering, Knowledge-Graph-Engineering, Terminologiemanagement, Data Stewardship und technische Projektteams.
Voraussetzungen: Grundkenntnisse in RDF und Datenmodellierung sowie praktische Erfahrung mit tabellarischen oder strukturierten Quelldaten.
Didaktik und Arbeitsweise
Kurze Fachimpulse werden unmittelbar durch Demonstrationen, strukturierte Konfigurationsschritte, Praxisübungen und kontrollierte Fehlerfälle vertieft. Jede Übung verwendet definierte Ausgangswerte, Prüfpunkte und Dokumentationsanforderungen, damit die erarbeiteten Abläufe als reproduzierbarer Arbeits- oder Betriebsstandard einsetzbar bleiben.
Fachbereichsleitung und Trainerteam
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de
Seminardetails
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weiterer Tag 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Data Engineering, Knowledge-Graph-Engineering, Terminologiemanagement, Data Stewardship und technische Projektteams |
| Voraussetzungen: | Grundkenntnisse in RDF und Datenmodellierung sowie praktische Erfahrung mit tabellarischen oder strukturierten Quelldaten |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhouse, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
