Děkujeme za vaši dotaz! Jeden z našich pracovníků vás brzy kontaktuje.
Děkujeme za rezervaci! Jeden z našich pracovníků vás brzy kontaktuje.
Doba trvání 21 hodiny
Návrh Školení
Základy ladění a evaluace v Mastra
- Rozumění modelům chování agentů a módům selhání
- Základní principy ladění v rámci Mastra
- Evaluace deterministických a nedeterministických akcí agentů
Nastavení prostředí pro testování agentů
- Konfigurace testovacích sandboxů a izolovaných prostorů pro evaluaci
- Zachytávání logů, stop a telemetrie pro podrobnou analýzu
- Příprava datových sad a promptů pro strukturované testování
Ladění chování AI agentů
- Sledování cest rozhodování a interních signálů úvah
- Identifikace halucinací, chyb a nechtěných chování
- Použití dashboardů pro observability k vyhledávání příčin
Metriky evaluace a frameworky benchmarkingů
- Definice kvantitativních a kvalitativních metrik evaluace
- Měření přesnosti, konzistence a kontextového souladu
- Aplikace benchmarkových datových sad pro reprodukovatelné hodnocení
Spolehlivostní inženýrství pro AI agenty
- Navrhování testů spolehlivosti pro dlouhodobě běžící agenty
- Detekce driftu a degradace výkonu agentů
- Implementace opatření pro kritické workflow
Procesy zajišťování kvality a automatizace
- Stavba QA pipeline pro kontinuální evaluaci
- Automatizace regresních testů pro aktualizace agentů
- Integrace QA s CI/CD a podnikovými workflow
Pokročilé techniky pro snižování halucinací
- Strategie promptingu pro omezení nevyhovujících výstupů
- Validační smyčky a mechanismy samokontroly
- Experimentování s kombinacemi modelů pro zlepšení spolehlivosti
Reporting, monitorování a kontinuální zlepšování
- Vytváření QA zpráv a skóreagentů
- Monitorování dlouhodobého chování a vzorců chyb
- Iterace evaluačních frameworků pro vyvíjející se systémy
Shrnutí a další kroky
Požadavky
- Pochopení chování AI agentů a interakcí modelů
- Zkušenosti s laděním nebo testováním komplexních softwarových systémů
- Znalost nástrojů pro observability nebo logging
Cílová skupina
- QA inženýři
- Inženýři pro spolehlivost AI
- Developmenti zodpovědní za kvalitu a výkon agentů