Schulungsübersicht
SRE-Antipatterns
- Identifizierung kontraproduktiver Praktiken
- Erkennen der Auswirkungen von Antipatterns auf die Zuverlässigkeit
- Best Practices und corrective Alternativen
SLOs als Indikator für Kundenzufriedenheit
- Definition von Service Level Indicators (SLIs) und Service Level Objectives (SLOs)
- Verwaltung von Error Budgets und Ausbalancierung von Innovation und Zuverlässigkeit
- Verständnis der Grenzen verteilter Systeme
Aufbau sicherer und zuverlässiger Systeme
- Design für Fehlertoleranz und Resilienz
- Integration von Sicherheit in das Reliability Engineering
- Strategien für Skalierbarkeit und DatenSchutz
Vollständige Observability (Ganzheitliche Beobachtbarkeit)
- Instrumentierung und Erfassung von Metriken
- Verteiltes Tracing und synthetisches Monitoring
- Observability-getriebene Entwicklung
Platform Engineering und AIOps
- Plattformspezifische Engineering-Ansätze
- Automatisierung und Orchestrierung im SRE
- Nutzung von DataOps und operationellem Intelligence
Incident Management im SRE
- Rollen und Verantwortlichkeiten im Incident Response
- Anwendung von Frameworks wie OODA
- Automatisierte Fehlerbehebung und KI/ML-gestützte Lösungsfälle
Chaos Engineering
- Prinzipien und Strategien für Resilienztests
- Planung und Durchführung von „Game Day“-Übungen
- Lernen aus kontrollierten Fehlschlagsexperimenten
SRE als reine Form von DevOps
- Integration von SRE in DevOps-Workflows
- Kulturelle Ausrichtung und Kollaborationspraktiken
- Förderung organisatorischer Transformationen durch SRE
Übungen nach der Klassenzeit
- Case Studies zum Design großer Systeme
- Fortgeschrittene Szenarien für Instrumentierung und Monitoring
- Lösung realer Zuverlässigkeitsprobleme
Wiederholung und Prüfungsvorbereitung
- Abschlusswiederholung des DevOps Institute SRE Practitioner Lehrplans
- Musterfragen und Übungstests
- Strategien und Empfehlungen für die Prüfungsabwicklung
Zusammenfassung und nächste Schritte
Voraussetzungen
- Verständnis der Kernprinzipien des Site Reliability Engineering
- Erfahrung mit DevOps-Praktiken und verwandten Tools
- Kenntnisse im Systemmonitoring, Incident Management und in Automatisierungsprozessen
Zielgruppe
- SRE-Professionals, die die DevOps Institute SRE Practitioner Zertifizierung anstreben
- DevOps-Engineers, die ihre Expertise auf Reliabilitäts-Fokussierte Rollen ausweiten möchten
- Operations-Verantwortliche, die für Reliabilitätsstrategie und -ausführung zuständig sind
Erfahrungsberichte (2)
Craig war extrem engagiert im Training und hat stets darauf geachtet, dass wir aufmerksam sind. Er passte die Beispiele an unsere täglichen Aktivitäten an und gab immer eine Antwort, wenn danach gefragt wurde, auch wenn die Information nicht im Präsentationsmaterial enthalten war.
Ecaterina Ioana Nicoale - BOOKING HOLDINGS ROMANIA SRL
Kurs - DevOps Foundation®
Maschinelle Übersetzung
Hoher Einsatz und Fachwissen des Trainers
Jacek - Softsystem
Kurs - DevOps Engineering Foundation (DOEF)®
Maschinelle Übersetzung