Návrh Školení
Základy provozu cloudových služeb na platformě AWS
- Role a povinnosti v oblasti operací ve cloudu
- Struktura účtů AWS, organizace a strategie víceúčtového provozu
- Klíčové operační služby: CloudWatch, CloudTrail, AWS Config
Infrastruktura jako kód a její zřizování
- Zásady využití přístupu Infrastructure-as-Code a principy nezměnitelné infrastruktury
- Zřizování prostředků pomocí nástrojů Terraform a AWS CloudFormation
- Správa stavu systému, modulů a postupného přechodu mezi jednotlivými prostředími
Strategie nasazování a CI/CD procesy
- Návrh CI/CD pipeline pro cloudová řešení
- Metody nasazování typu Blue/Green, Canary a postupné aktualizace
- Automatizace vracení změn, kontroly stavu systému a validace nových verzí
Monitorování, sledování chování systémů a upozorňování
- Metriky, logy a stopy: jejich odesílání, ukládání a analýza
- Využití nástrojů CloudWatch, X-Ray a dalších systémů pro monitorování
- Definice SLO/SLI parametrů, pravidel pro upozorňování a postupů při vyřizování hlášených problémů
Bezpečnostní operace a správa identit
- Osvědčené postupy při práci s IAM, princip minimálních oprávnění a způsoby zajištění přístupu mezi účty
- Správa tajných informací, používání KMS a bezpečných systémů pro ukládání parametrů
- Opatření k zajištění provozní bezpečnosti: strategie oprav chyb, kontrola zranitelností a vedení auditních záznamů
Odolnost systémů, zálohování a obnova po katastrofách
- Návrh řešení s ohledem na odolnost vůči chybám a maximální dostupnost
- Strategie zálohování, automatizace tvorby snímků a postupy obnovy dat
- Plánování opatření při katastrofách a sestavování postupů pro reakci na incidenty
Optimalizace nákladů a správa prostředků
- Zviditelnění nákladů: fakturace, označování zdrojů a strategie alokace výdajů
- Přizpůsobování velikosti prostředků, využívání rezervovaných instancí a plánů úspor, stejně jako kontrola rozpočtu
- Řízení: definování pravidel, omezení a automatizace postupů k zajištění souladu s předpisy
Provoz kontejnerových řešení, serverless technologií a běhových prostředí
- Postupy pro správu služeb ECS, EKS a Lambda
- Hledání služeb v síti, automatické měření kapacity systémů a stanovení limitů zdrojů
- Logování, sledování chování a ladění kontejnerizovaných aplikací
Reakce na incidenty, postupy pro řešení problémů a chaos engineering
- Řešení incidentů podle předem stanovených postupů a následná vyhodnocování událostí
- Automatizace nápravných kroků a systémů samoopravných sebe sama
- Seznámení s experimenty typu chaos engineering zaměřenými na ověřování odolnosti systému
Praktický workshop: Provoz ukázkového pracovního zatížení
- Nasazení ukázkové aplikace s využitím principů Infrastructure-as-Code a CI/CD pipeline
- Implementace monitorování, upozorňování a automatických skriptů pro nápravu problémů
- Simulace výskytu problémů a procvičení reakcí podle předem stanovených postupů
Shrnutí a další kroky
Požadavky
- Základní znalost konceptů cloud computingu a síťových technologií
- Orientace v příkazovém řádku Linuxu a základy skriptování
- Zkušenosti se správou verzí kódu (Git) a s obecnými koncepty CI/CD
Cílová skupina
- Inženýři pro provoz cloudových služeb
- SRE specialisté a platformní inženýři
- DevOps inženýři a vedoucí technických týmů
Reference (1)
Zjistil jsem nové zajímavé věci o Lambdě a serverless architektuře.
Oleg Buldumac - PUBLIC COURSE
Kurz - AWS Lambda for Developers
Přeloženo strojem