Kontakt aufnehmen

Schulungsübersicht

Grundlagen des Cloud-Betriebs auf AWS

  • Operative Rollen und Verantwortlichkeiten in der Cloud
  • AWS-Kontostruktur, Organisationen und Multi-Account-Strategie
  • Kernbetriebsservices: CloudWatch, CloudTrail, AWS Config

Infrastructure as Code und Provisioning

  • Grundsätze von IaC und immutabler Infrastruktur
  • Provisioning mit Terraform und AWS CloudFormation
  • Verwaltung von State, Modulen und Umgebungsförderung

CI/CD und Deployment-Strategien

  • Entwurf von CI/CD-Pipelines für cloud-native Apps
  • Blue/Green-, Canary- und Rolling-Deployments
  • Automatisierung von Rollbacks, Health-Checks und Release-Validierung

Monitoring, Observability und Alerting

  • Metriken, Logs und Traces: Senden, Speichern und Analysieren
  • Nutzung von CloudWatch, X-Ray und Drittanbieter-Observability-Tools
  • Definition von SLOs/SLIs, Alerting-Policies und On-Call-Praktiken

Security Operations und Identity Management

  • IAM-Best Practices, Least Privilege und Cross-Account-Zugriff
  • Secrets Management, KMS und sichere Parameter-Stores
  • Betriebssicherheit: Patching-Strategien, Vulnerability-Scanning und Audit-Trails

Resilienz, Backup und Disaster Recovery

  • Design für Fehlertoleranz und hohe Verfügbarkeit
  • Backup-Strategien, Snapshot-Automatisierung und Restore-Prozeduren
  • Disaster-Recovery-Planung und Erstellung von Runbooks

Kostenoptimierung und Governance

  • Kostenübersicht: Abrechnung, Tagging und Kostenallokationsstrategien
  • Rightsizing, reservierte Instanzen/Savings-Pläne und Budgetkontrollen
  • Governance: Richtlinien, Guardrails und Automatisierung für Compliance

Container, Serverless und Runtime Operations

  • Operationale Überlegungen für ECS, EKS und Lambda
  • Service-Discovery, Autoscaling und Ressourcenlimits
  • Logging, Tracing und Debugging containerisierter Workloads

Incident Response, Playbooks und Chaos Engineering

  • Runbook-gestützte Incident Response und Postmortem-Praktiken
  • Automatisierung von Remediation und Self-Healing-Mustern
  • Einführung in Chaos-Experimente zur Validierung der Resilienz

Praxisworkshop: Betrieb einer Beispiel-Workload

  • Deployment einer Beispielanwendung unter Verwendung von IaC und einer CI/CD-Pipeline
  • Implementierung von Monitoring, Alerts und einem automatisierten Remediation-Skript
  • Simulation von Incidents und Übung der runbook-basierten Reaktion

Zusammenfassung und nächste Schritte

Voraussetzungen

  • Grundlegende Kenntnisse in Cloud-Konzepten und Networking
  • Vertrautheit mit der Linux-Kommandozeile und dem Scripting
  • Erfahrung mit Versionskontrolle (Git) und grundlegenden CI/CD-Konzepten

Zielgruppe

  • Cloud-Operations-Ingenieure
  • SREs und Plattform-Ingenieure
  • DevOps-Ingenieure und technische Teamleiter
 21 Stunden

Teilnehmerzahl


Preis je Teilnehmer (exkl. USt)

Erfahrungsberichte (1)

Kommende Kurse

Verwandte Kategorien