Beschreibung
Eine überzeugende Demonstration zeigt noch nicht, wie verlässlich eine Agentenanwendung im Alltag arbeitet. Dieses Seminar macht Qualität anhand konkreter Aufgaben, erwarteter Aktionen und messbarer Fehlerfolgen prüfbar. Unterschieden werden fachlicher Aufgabenerfolg, korrekte Werkzeugnutzung, sichere Prozessausführung und sprachliche Qualität. Dadurch lassen sich Verbesserungen gezielt bewerten und Fehlentwicklungen früher erkennen.
Eine vorbereitete Agentenanwendung dient als Prüfobjekt. Aus typischen und schwierigen Fällen entsteht ein versionierter Testbestand. Deterministische Prüfungen bilden die erste Stufe; menschliche Bewertungen und modellgestützte Bewertungen ergänzen sie dort, wo sie sinnvoll sind. Abschließend wird untersucht, welche Laufdaten im Betrieb tatsächlich benötigt werden und wie sich Alarmierung, Kostenübersicht und Datenschutzanforderungen miteinander verbinden lassen.
Der Prüffall ist ein Agent, der Serviceanfragen einordnet und eine begrenzte Aktion vorschlägt. Eine sprachlich gute Antwort kann trotzdem den falschen Vorgang betreffen oder eine unzulässige Änderung vorbereiten. Deshalb werden erwartete Werkzeugparameter, tatsächliche Seiteneffekte und die Qualität der Rückmeldung einzeln geprüft. Eine bewusst verschlechterte Konfiguration dient als Gegenprobe für den Testbestand. Das Seminar zeigt so, ob die ausgewählten Messgrößen die Fehler erkennen, die im späteren Einsatz tatsächlich relevant sind.
Seminarziele
- Fachliche Qualitätskriterien und belastbare Testfälle formulieren.
- Werkzeug-, Integrations- und vollständige Agentenläufe getrennt prüfen.
- Modellbewertungen mit menschlich geprüften Beispielen kalibrieren.
- Änderungen anhand von Regressionen, Kosten und Betriebskennzahlen bewerten.
Seminarinhalte
- Qualitätsmodell und Fallbestand
- Automatisierte Prüfungen
- Bewertungsverfahren
- Monitoring und Laufdiagnose
- Änderungen und Freigabe
Qualitätsmodell und Fallbestand
- Aufgabenerfolg und zulässige Aktionen je Anwendungsfall definieren.
- Typische, unklare, fehlerhafte und unzulässige Eingaben aufnehmen.
- Entwicklungsfälle von einem zurückgehaltenen Prüfbestand trennen.
Automatisierte Prüfungen
- Argumentvalidierung, Berechtigungen und Seiteneffekte deterministisch testen.
- Modellantworten für isolierte Tests durch vorbereitete Antworten ersetzen.
- Vollständige Läufe mit echten Modellen mehrfach ausführen und Streuung erfassen.
Bewertungsverfahren
- Rubriken mit nachvollziehbaren Kriterien und Gegenbeispielen erstellen.
- Menschliche und modellgestützte Urteile vergleichen und Abweichungen untersuchen.
- Unsichere Bewertungen und unterschiedliche Fehlerkosten ausdrücklich berücksichtigen.
Monitoring und Laufdiagnose
- Vorgänge über Modell- und Werkzeugaufrufe hinweg korrelieren.
- Laufzeit, Iterationen, Werkzeugfehler und geschätzte Kosten messen.
- Protokollinhalte minimieren und sensible Eingaben gezielt maskieren.
Änderungen und Freigabe
- Prompt-, Modell- und Werkzeugversionen gemeinsam nachvollziehbar halten.
- Neue Varianten gegen Baseline und Abnahmeschwellen prüfen.
- Gestufte Einführung, Rücknahme und Verantwortlichkeit für Qualitätsabfälle planen.
Praxisübungen
- Aus einem fachlichen Prozess einen versionierten Satz von Normal-, Grenz- und Fehlerfällen erstellen.
- Ein Prüfharness um Werkzeug- und Aktionsprüfungen ergänzen und einen absichtlich fehlerhaften Lauf erkennen.
- Eine Bewertungsrubrik mit menschlich geprüften Beispielen vergleichen und unzuverlässige Modellurteile sichtbar machen.
- Eine geänderte Modell- oder Promptkonfiguration mehrfach messen und anhand definierter Kriterien über ihre Freigabe entscheiden.
- Eine Laufübersicht mit Fehlern, Latenz und Kosten interpretieren und eine konkrete Alarmregel festlegen.
Arbeitsumgebung
Vorbereitete Python-Testumgebung mit einer lauffähigen Agentenanwendung, synthetischen Prüffällen und Beispieltraces. Ein vorhandenes Monitoringwerkzeug wird verwendet; sein vollständiger Plattformaufbau ist nicht enthalten.
Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
|---|---|
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Qualitätssicherer, Testautomatisierer, Agentenentwickler, technische Produktverantwortliche und Betriebsteams. |
| Voraussetzungen: | Verständnis von Agentenabläufen und Werkzeugaufrufen; Grundlagen automatisierter Tests und Python-Praxis für Anpassungen am vorbereiteten Prüfharness. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
