Schulungsübersicht
Grundlagen der Cloud-Operationen auf AWS
- Rollen und Aufgaben im Cloud-Betrieb
- AWS-Kontostruktur, Organisationseinheiten sowie Strategien zur Verwaltung mehrerer Konten
- Wichtige Betriebsdienste: CloudWatch, CloudTrail, AWS Config
Infrastructure as Code und automatisierte Bereitstellung
- Prinzipien des „Infrastructure as Code“ sowie unveränderlicher Infrastruktur
- Einrichtung von Ressourcen mittels Terraform und AWS CloudFormation
- Verwaltung von Systemzuständen, Modulen sowie Übergängen zwischen verschiedenen Umgebungen
CI/CD-Strategien und Deployment-Verfahren
- Entwurf von CI/CD-Pipelines für Cloud-Native-Anwendungen
- Strategien wie „Blue/Green“, Canary- und schrittweises Deployment
- Automatisierung von Rollback-Prozessen, Gesundheitsüberprüfungen sowie Freigabeverifikationen
Monitoring, Beobachtbarkeit und Alarmierung
- Messwerte, Protokolle sowie Ausgabedaten: Erfassung, Speicherung und Analyse
- Einsatz von CloudWatch, X-Ray sowie externen Beobachtbarkeitstools
- Festlegung von SLOs/SLIs, Alarmregeln sowie Vorgehensweisen für den Bereitschaftsdienst
Sicherheitsoperationen und Identitätsmanagement
- Best Practices für IAM, das Mindestprivileg-Prinzip sowie der sichere Zugriff zwischen Konten
- Verwaltung vertraulicher Daten, Nutzung von KMS sowie sichere Speichermethoden für Parameter
- Sicherheitsaspekte im Betrieb: Patch-Strategien, Schwachstellenscans und Nachverfolgung von Änderungen
Ausfallsicherheit, Datensicherung und Notfallwiederherstellung
- Gestaltung fehlertoleranter Systeme mit hoher Verfügbarkeit
- Verfahren zur Datensicherung, automatisierte Erstellung von Snapshots sowie Wiederherstellungsprozesse
- Planung für Notfallsituationen sowie Entwicklung entsprechender Handlungsanweisungen
Kostenoptimierung und Compliance-Verwaltung
- Transparente Kostenkontrolle: Abrechnung, Tagging sowie Strategien zur Zuordnung der Ausgaben
- Ressourcen optimieren durch richtige Dimensionierung, Reserved Instances/Savings Plans und Budgetgrenzen
- Governance: Durchsetzung von Regeln sowie automatisierte Überwachungsmechanismen zur Einhaltung gesetzlicher Vorgaben
Container-Technologien, Serverless-Dienste und Betriebsaspekte
- Besonderheiten beim Betrieb von ECS, EKS sowie Lambda-Funktionen
- Service-Discovery, automatische Skalierung und Grenzregelungen für Ressourcenverbrauch
- Aufzeichnung, Nachverfolgung sowie Fehlerbehebung bei Container-basierten Anwendungen
Fehlerreaktion, SOPs und Chaos Engineering
- Fehlerbehebung nach vordefinierten Vorgehensweisen und Dokumentation von Vorfällen
- Automatisierte Lösungsfindungen sowie Mechanismen zur Selbstreparatur von Systemen
- Einführung in Chaos-Experimente, um die Widerstandsfähigkeit der Infrastruktur zu testen
Praktisches Workshop-Modul: Betrieb einer Beispiel-Anwendung
- Deployment der Beispiel-Anwendung mithilfe von Infrastructure as Code und einem CI/CD-Prozess
- Einrichtung des Monitorings, Benachrichtigungsmechanismen sowie eines automatisierten Reparatur-Skripts
- Simulation von Fehlermeldungen und Übung der reaktiven Maßnahmen basierend auf den definierten Handlungsplänen
Zusammenfassung und weitere Schritte
Voraussetzungen
- Grundkenntnisse in Cloud-Konzepten und Netzwerktechnik
- Vertrautheit mit der Linux-Command-Line sowie Skriptprogrammierung
- Erfahrung im Umgang mit Quellcode-Verwaltung (Git) sowie Grundkenntnisse in CI/CD-Prozessen
Zielgruppe
- Cloud-Operationen-Ingenieure
- SREs sowie Plattform-Ingenieure
- DevOps-Ingenieure und technische Teamleiter
Erfahrungsberichte (1)
Ich habe neue interessante Dinge über Lambda und Serverless erfahren.
Oleg Buldumac - PUBLIC COURSE
Kurs - AWS Lambda for Developers
Maschinelle Übersetzung