Zkuste nás kontaktovat
 Doba trvání 14 hodiny

Návrh Školení

Úvod do AIOps

  • Co je AIOps a proč je důležité
  • Tradiční monitorování vs. observability poháněná AIOps
  • Architektura AIOps a klíčové komponenty

Sběr a normalizace operačních dat

  • Typy observability dat: metriky, logy a trasy
  • Přečerpávání dat z více zdrojů (servery, kontejnery, cloud)
  • Použití agentů a exporterů (Prometheus, Beats, Fluentd)

Korelace dat a detekce anomalií

  • Korelace časových řad a statistické metody
  • Použití ML modelů pro detekci anomalií
  • Detekce incidentů v distribuovaných systémech

Alerty a redukce šumu

  • Navrhování inteligentních pravidel a prahových hodnot alertů
  • Potlačení, de-duplikace a skupinování alertů
  • Integrace s Alertmanager, Slack, PagerDuty nebo Opsgenie

Analýza příčin a vizualizace

  • Použití dashboardů k vizualizaci metrik a detekci trendů
  • Prozkoumávání událostí a časových os pro RCA (analýzu příčin)
  • Sledování problémů napříč vrstvami pomocí nástrojů distribuovaného sledování

Automatizace a opravy

  • Spouštění automatizovaných skriptů nebo workflow z incidentů
  • Integrace s ITSM systémy (ServiceNow, Jira)
  • Případy použití: samoopracování, škálování, přesměrování provozu

Open-source a komerční AIOps platformy

  • Přehled nástrojů: Prometheus, Grafana, ELK, Moogsoft, Dynatrace
  • Kritéria pro výběr AIOps platformy
  • Demo a praktická ukázka s vybraným stackem

Shrnutí a další kroky

Požadavky

  • Znalost konceptů IT operací a monitorování systémů
  • Zkušenosti s nástroji monitorování nebo dashboardy
  • Ověřenost se základními formáty logů a metrik

Cílová skupina

  • Operační týmy zodpovědné za infrastrukturu a aplikace
  • Inženýři pro spolehlivost lokalit (SRE)
  • Týmy IT monitorování a observability

Počet účastníků


Cena za účastníka

Nadcházející kurzy

Související kategorie