Děkujeme za vaši dotaz! Jeden z našich pracovníků vás brzy kontaktuje.
Děkujeme za rezervaci! Jeden z našich pracovníků vás brzy kontaktuje.
Doba trvání 14 hodiny
Návrh Školení
Úvod do AIOps
- Co je AIOps a proč je důležité
- Tradiční monitorování vs. observability poháněná AIOps
- Architektura AIOps a klíčové komponenty
Sběr a normalizace operačních dat
- Typy observability dat: metriky, logy a trasy
- Přečerpávání dat z více zdrojů (servery, kontejnery, cloud)
- Použití agentů a exporterů (Prometheus, Beats, Fluentd)
Korelace dat a detekce anomalií
- Korelace časových řad a statistické metody
- Použití ML modelů pro detekci anomalií
- Detekce incidentů v distribuovaných systémech
Alerty a redukce šumu
- Navrhování inteligentních pravidel a prahových hodnot alertů
- Potlačení, de-duplikace a skupinování alertů
- Integrace s Alertmanager, Slack, PagerDuty nebo Opsgenie
Analýza příčin a vizualizace
- Použití dashboardů k vizualizaci metrik a detekci trendů
- Prozkoumávání událostí a časových os pro RCA (analýzu příčin)
- Sledování problémů napříč vrstvami pomocí nástrojů distribuovaného sledování
Automatizace a opravy
- Spouštění automatizovaných skriptů nebo workflow z incidentů
- Integrace s ITSM systémy (ServiceNow, Jira)
- Případy použití: samoopracování, škálování, přesměrování provozu
Open-source a komerční AIOps platformy
- Přehled nástrojů: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
- Kritéria pro výběr AIOps platformy
- Demo a praktická ukázka s vybraným stackem
Shrnutí a další kroky
Požadavky
- Znalost konceptů IT operací a monitorování systémů
- Zkušenosti s nástroji monitorování nebo dashboardy
- Ověřenost se základními formáty logů a metrik
Cílová skupina
- Operační týmy zodpovědné za infrastrukturu a aplikace
- Inženýři pro spolehlivost lokalit (SRE)
- Týmy IT monitorování a observability