Dieses praxisorientierte Seminar behandelt Retrieval-Augmented Generation, Dokumentvorbereitung, Chunking, Vektorisierung, Hybrid Retrieval, Reranking, Single- und Grouped-Task, Prompt-Design, Quellenbindung, Evaluation und Produktionsbetrieb. Alle Arbeitsschritte werden an einer durchgängigen Referenzumgebung ausgeführt, geprüft und in wiederverwendbaren Arbeitsvorlagen dokumentiert.
Inhaltsübersicht
- RAG-Zielbild und Qualitätskriterien
- Dokumentaufbereitung
- Collection und Vektorisierung
- Retrieval-Pipeline
- Generative Suche
- Evaluation
- Produktionsbetrieb
- Lernziele und Abnahmekriterien
- Praxisübungen und Betriebsdokumentation
Lernziele
- Anforderungen in den Bereichen RAG-Zielbild und Qualitätskriterien, Retrieval-Pipeline und Produktionsbetrieb strukturiert analysieren und in eine umsetzbare Weaviate-Konfiguration überführen.
- Collections, Daten, Abfragen oder Betriebsparameter nachvollziehbar konfigurieren und mit reproduzierbaren Prüfungen verifizieren.
- Fehlersituationen systematisch eingrenzen, geeignete Diagnoseinformationen erfassen und belastbare Korrekturmaßnahmen ableiten.
- Qualität, Leistung, Sicherheit und Wartbarkeit anhand definierter Kriterien bewerten und die Lösung für den Regelbetrieb dokumentieren.
Schritt-für-Schritt-Inhalte
1. RAG-Zielbild und Qualitätskriterien
Schwerpunkt: Fragetypen, Wissensquellen, Aktualität, Antwortgrenzen, Quellenanforderung, Latenz, Kosten und Datenschutz.
- Anforderungen für RAG-Zielbild und Qualitätskriterien erfassen: Fragetypen, Wissensquellen, Aktualität, Antwortgrenzen, Quellenanforderung, Latenz, Kosten und Datenschutz; Zielzustand, Eingaben, Abhängigkeiten und messbare Prüfkriterien in einer Arbeitsvorlage festhalten.
- Technische Grundlage konfigurieren: passende Collections, Properties, Clients, Modelle, Indizes oder Infrastrukturparameter auswählen und jede Einstellung mit ihrem Zweck dokumentieren.
- Vorgehen mit repräsentativen Daten ausführen: Ausgangszustand prüfen, Operation schrittweise durchführen, Rückgaben protokollieren und das erwartete Verhalten gegen die Prüfkriterien vergleichen.
- Fehler- und Grenzfälle untersuchen: ungültige Eingaben, fehlende Berechtigungen, leere Ergebnisse, Zeitüberschreitungen oder Ressourcenengpässe gezielt auslösen und diagnostizieren.
- Ergebnis absichern: Qualität, Latenz, Ressourcenbedarf, Sicherheit und Wartbarkeit bewerten; Konfiguration und Wiederholungsablauf als wiederverwendbares Runbook festhalten.
2. Dokumentaufbereitung
Schwerpunkt: Extraktion, Bereinigung, Chunking, Überlappung, Metadaten, UUIDs, Versionen und Löschstrategie.
- Anforderungen für Dokumentaufbereitung erfassen: Extraktion, Bereinigung, Chunking, Überlappung, Metadaten, UUIDs, Versionen und Löschstrategie; Zielzustand, Eingaben, Abhängigkeiten und messbare Prüfkriterien in einer Arbeitsvorlage festhalten.
- Technische Grundlage konfigurieren: passende Collections, Properties, Clients, Modelle, Indizes oder Infrastrukturparameter auswählen und jede Einstellung mit ihrem Zweck dokumentieren.
- Vorgehen mit repräsentativen Daten ausführen: Ausgangszustand prüfen, Operation schrittweise durchführen, Rückgaben protokollieren und das erwartete Verhalten gegen die Prüfkriterien vergleichen.
- Fehler- und Grenzfälle untersuchen: ungültige Eingaben, fehlende Berechtigungen, leere Ergebnisse, Zeitüberschreitungen oder Ressourcenengpässe gezielt auslösen und diagnostizieren.
- Ergebnis absichern: Qualität, Latenz, Ressourcenbedarf, Sicherheit und Wartbarkeit bewerten; Konfiguration und Wiederholungsablauf als wiederverwendbares Runbook festhalten.
3. Collection und Vektorisierung
Schwerpunkt: Properties, Vektorisierer, Named Vectors, Generativmodell, Modellparameter und technische Verbindung.
- Anforderungen für Collection und Vektorisierung erfassen: Properties, Vektorisierer, Named Vectors, Generativmodell, Modellparameter und technische Verbindung; Zielzustand, Eingaben, Abhängigkeiten und messbare Prüfkriterien in einer Arbeitsvorlage festhalten.
- Technische Grundlage konfigurieren: passende Collections, Properties, Clients, Modelle, Indizes oder Infrastrukturparameter auswählen und jede Einstellung mit ihrem Zweck dokumentieren.
- Vorgehen mit repräsentativen Daten ausführen: Ausgangszustand prüfen, Operation schrittweise durchführen, Rückgaben protokollieren und das erwartete Verhalten gegen die Prüfkriterien vergleichen.
- Fehler- und Grenzfälle untersuchen: ungültige Eingaben, fehlende Berechtigungen, leere Ergebnisse, Zeitüberschreitungen oder Ressourcenengpässe gezielt auslösen und diagnostizieren.
- Ergebnis absichern: Qualität, Latenz, Ressourcenbedarf, Sicherheit und Wartbarkeit bewerten; Konfiguration und Wiederholungsablauf als wiederverwendbares Runbook festhalten.
4. Retrieval-Pipeline
Schwerpunkt: Vektor-, Keyword- und Hybridabfrage, Filter, Kandidatenmenge, Reranking, Distanz- und Score-Grenzen.
- Anforderungen für Retrieval-Pipeline erfassen: Vektor-, Keyword- und Hybridabfrage, Filter, Kandidatenmenge, Reranking, Distanz- und Score-Grenzen; Zielzustand, Eingaben, Abhängigkeiten und messbare Prüfkriterien in einer Arbeitsvorlage festhalten.
- Technische Grundlage konfigurieren: passende Collections, Properties, Clients, Modelle, Indizes oder Infrastrukturparameter auswählen und jede Einstellung mit ihrem Zweck dokumentieren.
- Vorgehen mit repräsentativen Daten ausführen: Ausgangszustand prüfen, Operation schrittweise durchführen, Rückgaben protokollieren und das erwartete Verhalten gegen die Prüfkriterien vergleichen.
- Fehler- und Grenzfälle untersuchen: ungültige Eingaben, fehlende Berechtigungen, leere Ergebnisse, Zeitüberschreitungen oder Ressourcenengpässe gezielt auslösen und diagnostizieren.
- Ergebnis absichern: Qualität, Latenz, Ressourcenbedarf, Sicherheit und Wartbarkeit bewerten; Konfiguration und Wiederholungsablauf als wiederverwendbares Runbook festhalten.
5. Generative Suche
Schwerpunkt: Single Prompt, Grouped Task, Kontextformat, Quellenmarker, Antwortformat, Unsicherheit und leere Treffer.
- Anforderungen für Generative Suche erfassen: Single Prompt, Grouped Task, Kontextformat, Quellenmarker, Antwortformat, Unsicherheit und leere Treffer; Zielzustand, Eingaben, Abhängigkeiten und messbare Prüfkriterien in einer Arbeitsvorlage festhalten.
- Technische Grundlage konfigurieren: passende Collections, Properties, Clients, Modelle, Indizes oder Infrastrukturparameter auswählen und jede Einstellung mit ihrem Zweck dokumentieren.
- Vorgehen mit repräsentativen Daten ausführen: Ausgangszustand prüfen, Operation schrittweise durchführen, Rückgaben protokollieren und das erwartete Verhalten gegen die Prüfkriterien vergleichen.
- Fehler- und Grenzfälle untersuchen: ungültige Eingaben, fehlende Berechtigungen, leere Ergebnisse, Zeitüberschreitungen oder Ressourcenengpässe gezielt auslösen und diagnostizieren.
- Ergebnis absichern: Qualität, Latenz, Ressourcenbedarf, Sicherheit und Wartbarkeit bewerten; Konfiguration und Wiederholungsablauf als wiederverwendbares Runbook festhalten.
6. Evaluation
Schwerpunkt: Retrieval-Relevanz, Antworttreue, Vollständigkeit, Halluzinationen, Testdatensatz, Regression und Freigabeschwellen.
- Anforderungen für Evaluation erfassen: Retrieval-Relevanz, Antworttreue, Vollständigkeit, Halluzinationen, Testdatensatz, Regression und Freigabeschwellen; Zielzustand, Eingaben, Abhängigkeiten und messbare Prüfkriterien in einer Arbeitsvorlage festhalten.
- Technische Grundlage konfigurieren: passende Collections, Properties, Clients, Modelle, Indizes oder Infrastrukturparameter auswählen und jede Einstellung mit ihrem Zweck dokumentieren.
- Vorgehen mit repräsentativen Daten ausführen: Ausgangszustand prüfen, Operation schrittweise durchführen, Rückgaben protokollieren und das erwartete Verhalten gegen die Prüfkriterien vergleichen.
- Fehler- und Grenzfälle untersuchen: ungültige Eingaben, fehlende Berechtigungen, leere Ergebnisse, Zeitüberschreitungen oder Ressourcenengpässe gezielt auslösen und diagnostizieren.
- Ergebnis absichern: Qualität, Latenz, Ressourcenbedarf, Sicherheit und Wartbarkeit bewerten; Konfiguration und Wiederholungsablauf als wiederverwendbares Runbook festhalten.
7. Produktionsbetrieb
Schwerpunkt: Caching, Timeouts, Retry, Modellfehler, Monitoring, Kostenkontrolle, Feedback und Aktualisierung der Wissensbasis.
- Anforderungen für Produktionsbetrieb erfassen: Caching, Timeouts, Retry, Modellfehler, Monitoring, Kostenkontrolle, Feedback und Aktualisierung der Wissensbasis; Zielzustand, Eingaben, Abhängigkeiten und messbare Prüfkriterien in einer Arbeitsvorlage festhalten.
- Technische Grundlage konfigurieren: passende Collections, Properties, Clients, Modelle, Indizes oder Infrastrukturparameter auswählen und jede Einstellung mit ihrem Zweck dokumentieren.
- Vorgehen mit repräsentativen Daten ausführen: Ausgangszustand prüfen, Operation schrittweise durchführen, Rückgaben protokollieren und das erwartete Verhalten gegen die Prüfkriterien vergleichen.
- Fehler- und Grenzfälle untersuchen: ungültige Eingaben, fehlende Berechtigungen, leere Ergebnisse, Zeitüberschreitungen oder Ressourcenengpässe gezielt auslösen und diagnostizieren.
- Ergebnis absichern: Qualität, Latenz, Ressourcenbedarf, Sicherheit und Wartbarkeit bewerten; Konfiguration und Wiederholungsablauf als wiederverwendbares Runbook festhalten.
Praxisübungen
- Übung 1: RAG-Zielbild und Qualitätskriterien – Fragetypen, Wissensquellen, Aktualität, Antwortgrenzen, Quellenanforderung, Latenz, Kosten und Datenschutz in einer vorbereiteten Referenzumgebung konfigurieren, ausführen, mit Negativtests prüfen und in einem Abnahmeprotokoll dokumentieren.
- Übung 2: Collection und Vektorisierung – Properties, Vektorisierer, Named Vectors, Generativmodell, Modellparameter und technische Verbindung in einer vorbereiteten Referenzumgebung konfigurieren, ausführen, mit Negativtests prüfen und in einem Abnahmeprotokoll dokumentieren.
- Übung 3: Evaluation – Retrieval-Relevanz, Antworttreue, Vollständigkeit, Halluzinationen, Testdatensatz, Regression und Freigabeschwellen in einer vorbereiteten Referenzumgebung konfigurieren, ausführen, mit Negativtests prüfen und in einem Abnahmeprotokoll dokumentieren.
- Übung 4: Produktionsbetrieb – Caching, Timeouts, Retry, Modellfehler, Monitoring, Kostenkontrolle, Feedback und Aktualisierung der Wissensbasis in einer vorbereiteten Referenzumgebung konfigurieren, ausführen, mit Negativtests prüfen und in einem Abnahmeprotokoll dokumentieren.
Zielgruppe
AI Engineers, ML Engineers, Backend-Entwickler, Data Scientists und Teams für Wissensassistenten oder generative Suche.
Voraussetzungen
Grundkenntnisse in Weaviate, Embeddings und generativen Sprachmodellen sowie Programmiererfahrung.
Fachbereichsleitung und Trainerteam
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | AI Engineers, ML Engineers, Backend-Entwickler, Data Scientists und Teams für Wissensassistenten oder generative Suche |
| Voraussetzungen: | Grundkenntnisse in Weaviate, Embeddings und generativen Sprachmodellen sowie Programmiererfahrung |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Fachvortrag, Demonstrationen, angeleitete Schritt-für-Schritt-Übungen, Fehlersimulationen und Praxisaufgaben am System |
| Seminararten: | Öffentlich, Webinar, Inhouse, Workshop - alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Ausführliche Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- und Warmgetränke, Mittagessen wahlweise vegetarisch |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
