Thank you for sending your enquiry! One of our team members will contact you shortly.
Thank you for sending your booking! One of our team members will contact you shortly.
Duration 21 hours
Course Outline
Foundations of AWS Cloud Operations
- Defining operational roles and responsibilities in the cloud.
- AWS account structure, organization, and multi-account strategies.
- Key operational services: CloudWatch, CloudTrail, and AWS Config.
Infrastructure as Code and Provisioning
- Core principles of IaC and immutable infrastructure.
- Provisioning resources with Terraform and AWS CloudFormation.
- Handling state, modules, and environment promotion.
CI/CD and Deployment Strategies
- Designing CI/CD pipelines for cloud-native applications.
- Implementing Blue/Green, canary, and rolling deployment methods.
- Automating rollbacks, health checks, and release validation.
Monitoring, Observability, and Alerting
- Managing metrics, logs, and traces: shipping, storing, and analysis.
- Utilizing CloudWatch, X-Ray, and third-party observability tools.
- Setting SLOs/SLIs, alerting policies, and on-call workflows.
Security Operations and Identity Management
- IAM best practices, least privilege principles, and cross-account access.
- Secrets management, KMS, and secure parameter stores.
- Operational security: patching strategies, vulnerability scanning, and audit trails.
Resilience, Backup, and Disaster Recovery
- Designing systems for fault tolerance and high availability.
- Backup strategies, snapshot automation, and restoration procedures.
- Disaster recovery planning and developing runbooks.
Cost Optimization and Governance
- Gaining cost visibility through billing, tagging, and allocation strategies.
- Rightsizing, reserved instances/savings plans, and budget controls.
- Governance: implementing policies, guardrails, and compliance automation.
Containers, Serverless, and Runtime Operations
- Operational aspects of ECS, EKS, and Lambda.
- Service discovery, autoscaling, and resource limits.
- Logging, tracing, and debugging containerized workloads.
Incident Response, Playbooks, and Chaos Engineering
- Runbook-driven incident response and postmortem analysis.
- Automating remediation and self-healing patterns.
- Introduction to chaos experiments for resilience validation.
Hands-on Workshop: Operating a Sample Workload
- Deploying a sample application using IaC and a CI/CD pipeline.
- Implementing monitoring, alerts, and automated remediation scripts.
- Simulating incidents and practicing runbook-based responses.
Summary and Next Steps
Requirements
- Fundamental knowledge of cloud concepts and networking.
- Proficiency with the Linux command line and scripting.
- Familiarity with source control (Git) and core CI/CD principles.
Target Audience
- Cloud operations engineers.
- SREs and platform engineers.
- DevOps engineers and technical team leads.
Testimonials (1)
I've find out new interesting things about Lambda and Serverless