Kontakt aufnehmen

Schulungsübersicht

Anti-Pattern-Muster im SRE-Kontext

  • Identifizierung nachteiliger Praktiken
  • Auswirkungen solcher Muster auf die Systemzuverlässigkeit verstehen
  • Beste Vorgehensweisen sowie Korrekturmaßnahmen

SLO als Indikator für Kundenzufriedenheit

  • Definition von Service Level Indicators (SLIs) und Service Level Objectives (SLOs)
  • Fehlerbudgets verwalten – Balance zwischen Innovation und Zuverlässigkeit finden<\/li>
  • Grenzen verteilter Systeme erkennen

Entwicklung sicherer und zuverlässiger Systeme

  • Systemdesign unter Berücksichtigung von Fehlertoleranz und Resilienz
  • Sicherheitsaspekte in die Zuverlässigkeitsstrategie integrieren
  • Strategien zur Skalierbarkeit sowie Datensicherheit entwickeln

Vollständige Beobachtbarkeit im Systemumfeld

  • Instrumentierung und Sammlung von Metriken
  • Distributed Tracing sowie synthetische Überwachungsmechanismen
  • Entwicklung unter Einbeziehung der Beobachtbarkeit als Grundprinzip

Plattformengineering und AIOps

  • Ansätze des plattformzentrierten Engineerings
  • Automatisierung und Orchestrierung im Rahmen von SRE
  • Nutzung von DataOps sowie operativer Intelligenz zur Optimierung

Vorfallmanagement im SRE-Kontext

  • Rollen und Verantwortlichkeiten bei der Reaktion auf Vorfälle
  • Einsatz geeigneter Frameworks wie OODA
  • Automatisierte Behebungsmechanismen sowie KI-gestützte Lösungsfindung

Chaos Engineering – Methoden zur Resilienzprüfung

  • Grundsätze und Strategien für das Testen der Systemstabilität
  • Planung sowie Durchführung sogenannter „Game Day“-Übungen
  • Lernen aus kontrollierten Fehlerexperimenten

SRE als zentrale Form des DevOps-Ansatzes

  • Integration von SRE-Prinzipien in DevOps-Prozesse
  • Kulturelle Zusammenarbeit sowie Abstimmungsmechanismen fördern
  • Organisationswandel durch gezielte Einführung von SRE antreiben

Nach der Schulung: Übungen zur praktischen Anwendung

  • Fallstudien zum Entwurf groß angelegter Systeme
  • Praktische Aufgaben zu Instrumentierung und Überwachungsmethodik
  • Lösung realer Problemstellungen im Kontext von Zuverlässigkeit

Abschlusskontrolle sowie Prüfungsvorbereitung

  • Gesamte Überprüfung des SRE-Practitioner-Lehrplans des DevOps Institute
  • Probeaufgaben sowie Übungstests zum Testen des Wissensstands
  • Tipps und Empfehlungen für die erfolgreiche Teilnahme an der Prüfung

Zusammenfassung sowie weitere Schritte

Voraussetzungen

  • Grundkenntnisse der Kernprinzipien des Site Reliability Engineering
  • Erfahrung mit DevOps-Praktiken und zugehörigen Werkzeugen
  • Grundsätzliche Kenntnisse in Systemüberwachung, Vorfallmanagement sowie Automatisierung

Zielgruppe

  • SRE-Profis, die die Zertifizierung zum SRE Practitioner des DevOps Institute anstreben
  • DevOps-Ingenieure, die ihre Expertise in Richtung Zuverlässigkeit ausbauen möchten
  • Führungskräfte im Operationsbereich, für die die strategische Umsetzung von Zuverlässigkeitsmaßnahmen relevant ist
 35 Stunden

Teilnehmerzahl


Preis je Teilnehmer (exkl. USt)

Erfahrungsberichte (2)

Kommende Kurse

Verwandte Kategorien