Návrh Školení
Úvod do open-source monitorování sítě
- Vývoj v oblasti sledování sítě: od protokolu SNMP po moderní telemetrii
- Problémy spojené se závislostí na konkrétních dodavatelích u komerčních řešení
- Přehled o open-source nástrojích pro monitorování sítě
- LibreNMS vs. Zabbix: jak si vybrat vhodnou platformu
- Hybridní a komplementární strategie monitorování
Architektura a instalace LibreNMS
- Přehled architektury a jednotlivých komponent LibreNMS
- Instalace: ruční postup versus nasazení pomocí Dockeru
- Nastavení databáze (MySQL/MariaDB)
- Konfigurace webového serveru (Apache/Nginx s PHP-FPM)
- Konfigurace a ladění nástroje RRDtool
- Počáteční nastavení a ověření funkčnosti
Architektura a instalace Zabbixu
- Struktura Zabbixu: server, proxy, agent a frontend
- Metody instalace: balíčky, Docker nebo kompilace ze zdrojových kódů
- Nastavení a optimalizace databáze (MySQL/PostgreSQL/TimescaleDB)
- Konfigurace serveru a uživatelského rozhraní
- Pomocník pro počáteční konfiguraci<\/li>
- Počáteční plánování rozšiřitelnosti systému
Automatické vyhledávání zařízení a tvorba inventáře
- Automatické vyhledávání sítě v rámci LibreNMS
- Systém pro detekci sítě a automatickou registraci zařízení v Zabbixu
- Verze protokolu SNMP a jeho zabezpečení (v1, v2c, v3)
- Rozřazování a seskupování síťových zařízení
- Správa umístění a kontaktních informací
- Import, export a hromadná konfigurace zařízení
Podrobné seznámení se SNMP monitorováním
- Základy protokolu SNMP a popis MIB souborů
- Nastavení parametrů SNMP na síťových zařízeních (routery, switche, firewally)
- Monitorování vlastních OID hodnot a nastavení periodického dotazování
- Zabezpečení pomocí protokolu SNMPv3: ověřování a šifrování dat
- Řešení běžných problémů s komunikací přes SNMP
- Specifika využití SNMP u různých typů zařízení
Monitorování pomocí agentů
- Nainstalování a konfigurace agenta Zabbixu
- Agent Zabbix 2: nová generace nástroje vytvořeného v jazyku Go
- Integrace agenta LibreNMS s nástrojem check_mk
- Tvorba vlastních skriptů a nastavení uživatelských parametrů
- Rozdíly mezi pasivním a aktivním režimem fungování agentů
- Hromadné nasazení agentů pomocí nástrojů typu Ansible, Puppet či Chef
Monitorování serverů se systémy Windows a Linux
- Sledování ukazatelů výkonnosti a stavu služeb v systému Windows
- Měření systémových metrik na linuxových serverech: CPU, paměť, disk i síť
- Monitorování běžících procesů a spuštěných služeb
- Kontrola obsahu log souborů a jejich analýza
- Sledování JVM a dalších aplikací na serverech
- Monitorování kontejnerů – Docker i Kubernetes
Monitorování síťového vybavení
- Sledování stavu jednotlivých portů, VLAN sítí, protokolu STP a MAC tabulek na switchech
- Monitoring routerů: BGP, OSPF i informací o směrování dat
- Hlídání stavu spojení, propustnosti síťe a aktivních pravidel u firewallů
- Sledování bezdrátových přístupových bodů
- Monitorování environmentálních faktorů: teploty, napájení či stav UPS zásobníků
- Kontrola využití rozhraní a detekce chybových stavů
Monitorování virtualizace a cloudových prostředí
- Integrace a monitorování prostředí VMware vSphere
- Sledování systému Proxmox VE
- Hlídání stavu Hyper-V virtuálních strojů
- Použití rozhraní API k monitorování služeb AWS, Azure či GCP
- Sledování prostředí OpenStack
- Monitorování systémů orchestrace kontejnerů
Typy sledovaných položek a sběr dat
- Různé typy sledovaných parametrů v Zabbixu: agent, SNMP, IPMI, JMX, SSH či Telnet
- Výpočtové položky a jejich agregace do komplexnějších ukazatelů
- Sledování vzájemně závislých prvků a předzpracování dat
- Moduly pro sběr dat a rozpoznávání operačních systémů v rámci LibreNMS
- Možnosti vytvoření vlastních metod získávání dat
- Typy a jednotky naměřených hodnot
Nastavení upozornění a spouštěčů akcí
- Funkce a syntaxe výrazů pro definování podmínek ve Zabbixu
- Řešení závislostí mezi různými spouštěči a korelace událostí
- Pravidla v LibreNMS pro automatické generování upozornění a jejich doručení
- Kanály přenosu notifikací: e-mail, SMS, Slack, PagerDuty či webhooky
- Pracovní postupy pro eskalaci problémů a potvrzení jejich řešení
- Nastavení plánovaných odstávek a režimů údržby systému
Vytváření dashboardů a vizualizace dat
- Pracovní plochy Zabbixu a jejich konfigurace
- Grafické widgety a mapy síťové topologie v rámci Zabbixu
- Možnosti přizpůsobení dashboardu LibreNMS podle potřeb uživatele
- Tvorba individuálních grafů a šablon pro jejich opětovné využití
- Vytváření map topologie sítě a automatickým vyhledáváním prvků
- Integrace nástroje Grafana pro pokročilou vizualizaci dat<
Sestavování reportů a analýza výsledků
- Sledování dostupnosti služeb a tvorba SLA reportů
- Plánování kapacity systému prostřednictvím statistik<
- Generování vlastních analytických výstupů podle potřeb uživatelů<
- Doručování reportů na základě předem nastavených harmonogramů<
- Předpovídání budoucího stavu systému na základě trendových analýz<
- Automatizace vytváření reportů pomocí API rozhraní<
Distribuované a vysoce dostupné monitorování<
- Použití proxy serverů Zabbix pro distribuci monitorovacích úloh do vzdálených lokalit<
- Vytvoření clusteru a zajištění vysoké dostupnosti Zabbix serveru<
- Nastavení více pollerů pro distribuci úloh v rámci LibreNMS<
- Rovnoměrné rozdělování zátěže mezi jednotlivé prvky systému<
- Strategie geografického rozložení monitorovacích komponent<
- Replikace a clusterizace databází pro zajištění integrity dat<
Optimalizace výkonu systému<
- Ladění parametrů databáze a její optimalizace podle aktuálních nároků<
- Zvyšování efektivity jednotlivých pollerů a zajištění souběžného vykonávání úloh<
- Správa prostoru pro ukládání historických dat i dlouhodobých trendů<
- Stanovení politik uchovávání a automatického mazání zastaralých záznamů<
- Používání mechanismů ukládání dat do mezipaměti<
- Doporučené metody škálování a určování výpočetního vybavení pro budoucí potřeby<
Zabezpečení systému a kontrola přístupu<
- Přihlašování uživatelů: integrace LDAP, SAML či ověřování dvěma faktory<
- Konfigurace rolí a přidělování oprávnění jednotlivým skupinám uživatelů<
- Ochrana konkrétních hostitelských skupin a šablon monitorovacích pravidel<
- Bezpečnost API rozhraní a správa přístupových tokenů<
- Sledování aktivit uživatelů pomocí auditních protokolů a zajištění shody s předpisy<
- Zabezpečená komunikace mezi prvky systému (TLS/SSL)<
Automatizace a integrace do dalších procesů<
- Použití API Zabbixu pro tvorbu skriptů a automatické operace<
- Možnosti automatizace v rámci nástroje LibreNMS<
- Využívání webhooků k propojení monitorovacího systému s ticketovými platformami<
- Použití modulů Ansible pro jednoduchou konfiguraci monitorovacích nástrojů<
- Integrace do CI/CD pracovních postupů a řídících systémů<
- Automatizace notifikací a komunikace s uživateli prostřednictvím nástrojů typu ChatOps<
Přechod z komerčních monitorovacích řešení<
- Vyhodnocení potřeb při nahrazování stávajících komerčních systémů<
- Doporučené strategie a nástroje pro migraci dat do nového prostředí<
- Fáze souběžného provozu původních i nových monitorovacích řešení<
- Školení personálu a tvorba kompletní dokumentace pro provoz systému<
- Poučky z reálných migrací již realizovaných v ostatních organizacích<
Osvědčené postupy při nasazení do produkčního prostředí<
- Příprava záloh a plánů obnovy po haváriích<
- Doporučené metody aktualizací systémů v provozním prostředí<
- Vytváření dokumentace a návodů k obsluze monitorovacích nástrojů<
- Pracovní postupy pro testování nových změn a jejich validaci<
- Spolupráce s komunitou open-source projektů a případné vkládání vlastních zlepšení do systému<
Požadavky
- Znalost síťových protokolů (SNMP, ICMP, TCP/UDP)
- Praktické zkušenosti s správou systémů Linux
- Všeobecné porozumění základním síťovým konceptům (subnety, směrování, přepínání)
- Orientace v databázových systémech (MySQL/PostgreSQL)
- Základní znalosti správy webových serverů
Cílová skupina
- Síťoví administrátoři a technici
- Systémoví administrátoři zodpovědní za monitorování infrastruktury
- Manažeři IT operací
- Inženýři pracující v NOC centrech a specialisté na monitorování
Reference (2)
Jak vzdělávací specialisté efektivně předávají znalosti
Vu Thoai Le - Reply Polska sp. z o. o.
Kurz - Certified Kubernetes Administrator (CKA) - exam preparation
Přeloženo strojem
Zajímavé laboratoře, pomoc vedení
Alexey - Tink Poland sp. z o. o.
Kurz - Certified Kubernetes Application Developer (CKAD) - exam preparation
Přeloženo strojem