Schulungsübersicht
Anti-Pattern-Muster im SRE-Kontext
- Identifizierung nachteiliger Praktiken
- Auswirkungen solcher Muster auf die Systemzuverlässigkeit verstehen
- Beste Vorgehensweisen sowie Korrekturmaßnahmen
SLO als Indikator für Kundenzufriedenheit
- Definition von Service Level Indicators (SLIs) und Service Level Objectives (SLOs)
- Fehlerbudgets verwalten – Balance zwischen Innovation und Zuverlässigkeit finden<\/li>
- Grenzen verteilter Systeme erkennen
Entwicklung sicherer und zuverlässiger Systeme
- Systemdesign unter Berücksichtigung von Fehlertoleranz und Resilienz
- Sicherheitsaspekte in die Zuverlässigkeitsstrategie integrieren
- Strategien zur Skalierbarkeit sowie Datensicherheit entwickeln
Vollständige Beobachtbarkeit im Systemumfeld
- Instrumentierung und Sammlung von Metriken
- Distributed Tracing sowie synthetische Überwachungsmechanismen
- Entwicklung unter Einbeziehung der Beobachtbarkeit als Grundprinzip
Plattformengineering und AIOps
- Ansätze des plattformzentrierten Engineerings
- Automatisierung und Orchestrierung im Rahmen von SRE
- Nutzung von DataOps sowie operativer Intelligenz zur Optimierung
Vorfallmanagement im SRE-Kontext
- Rollen und Verantwortlichkeiten bei der Reaktion auf Vorfälle
- Einsatz geeigneter Frameworks wie OODA
- Automatisierte Behebungsmechanismen sowie KI-gestützte Lösungsfindung
Chaos Engineering – Methoden zur Resilienzprüfung
- Grundsätze und Strategien für das Testen der Systemstabilität
- Planung sowie Durchführung sogenannter „Game Day“-Übungen
- Lernen aus kontrollierten Fehlerexperimenten
SRE als zentrale Form des DevOps-Ansatzes
- Integration von SRE-Prinzipien in DevOps-Prozesse
- Kulturelle Zusammenarbeit sowie Abstimmungsmechanismen fördern
- Organisationswandel durch gezielte Einführung von SRE antreiben
Nach der Schulung: Übungen zur praktischen Anwendung
- Fallstudien zum Entwurf groß angelegter Systeme
- Praktische Aufgaben zu Instrumentierung und Überwachungsmethodik
- Lösung realer Problemstellungen im Kontext von Zuverlässigkeit
Abschlusskontrolle sowie Prüfungsvorbereitung
- Gesamte Überprüfung des SRE-Practitioner-Lehrplans des DevOps Institute
- Probeaufgaben sowie Übungstests zum Testen des Wissensstands
- Tipps und Empfehlungen für die erfolgreiche Teilnahme an der Prüfung
Zusammenfassung sowie weitere Schritte
Voraussetzungen
- Grundkenntnisse der Kernprinzipien des Site Reliability Engineering
- Erfahrung mit DevOps-Praktiken und zugehörigen Werkzeugen
- Grundsätzliche Kenntnisse in Systemüberwachung, Vorfallmanagement sowie Automatisierung
Zielgruppe
- SRE-Profis, die die Zertifizierung zum SRE Practitioner des DevOps Institute anstreben
- DevOps-Ingenieure, die ihre Expertise in Richtung Zuverlässigkeit ausbauen möchten
- Führungskräfte im Operationsbereich, für die die strategische Umsetzung von Zuverlässigkeitsmaßnahmen relevant ist
Erfahrungsberichte (2)
Craig war extrem engagiert im Training und hat stets darauf geachtet, dass wir aufmerksam sind. Er passte die Beispiele an unsere täglichen Aktivitäten an und gab immer eine Antwort, wenn danach gefragt wurde, auch wenn die Information nicht im Präsentationsmaterial enthalten war.
Ecaterina Ioana Nicoale - BOOKING HOLDINGS ROMANIA SRL
Kurs - DevOps Foundation®
Maschinelle Übersetzung
Hoher Einsatz und Fachwissen des Trainers
Jacek - Softsystem
Kurs - DevOps Engineering Foundation (DOEF)®
Maschinelle Übersetzung