Kontakt aufnehmen

Schulungsübersicht

Einführung in Apache Iceberg

  • Überblick über Apache Iceberg
  • Wiederholung der grundlegenden Konzepte

Vertiefung in die Architektur von Apache Iceberg

  • Detaillierte Analyse des Tabellenformats von Apache Iceberg
  • Ausführliche Erläuterung der Gesamtarchitektur, einschließlich Metadatenverwaltung und Dateistruktur
  • Hintergründe zur Entwicklung von Schemas sowie zu Partitionierungseinstellungen​

Fortgeschrittene Installation und Konfiguration

  • Einstellung der optimalen Leistung von Apache Iceberg in verschiedenen Umgebungen
  • Integration mit mehreren gängigen Datenverarbeitungstools
  • Erweiterte Konfigurationen: Sicherheit, Verschlüsselung und Zugriffskontrolle
  • Aufbau von Apache Iceberg in einem verteilten Netzwerkumfeld

Fortgeschrittene Verwaltungs- und Wartungstechniken

  • Verwaltung sehr großer Apache-Iceberg-Tabellen
  • Implementierung sowie Handhabung komplexer Schemaänderungen
  • Bearbeitung von Änderungen bei der Partitionierung und versteckten Aufteilungsregeln
  • Fortgeschrittene CRUD-Operationen mit aktualisierten Schemas sowie Partitionierungen​

Techniken zur Abfrageoptimierung

  • Methoden zur Verkürzung der Laufzeit von Datenabfragen
  • Pruning von Partitionen sowie Auswahl relevanter Dateien
  • Caching und Optimierung des Metadatenmanagements
  • Anwendung und Test der Abfrageoptimierungsverfahren​

Leistungsoptimierung bei umfangreichen Datensätzen

  • Effiziente Verarbeitung sehr großer Datenmengen durch gezielte Anpassungen
  • Nutzung der internen Tools von Apache Iceberg zur Leistungssteigerung
  • Praxisbeispiele erfolgreicher Optimierungsmaßnahmen in echten Projekten
  • Anpassung der Systemeinsstellung bei großen Datenvolumina

Fortgeschrittene Migration und Integration von Daten

  • Übertragung komplexer Datenstrukturen aus anderen Systemen nach Apache Iceberg
  • Einbindung kontinuierlich fließender Echtzeitdaten in die Plattform
  • Komplette Migration komplexer Datensammlungen sowie deren Integration mit Live-Datenflüssen​

Zuverlässigkeit und Datentreue

  • Sicherstellung der Integrität sowie Konsistenz von Daten in verteilten Netzwerken
  • Einführung transaktionaler Regeln zur Garantie der Datentreue
  • Systematischer Umgang mit Fehlfunktionen sowie automatisierte Wiederherstellungsschritte
  • Implementierung von Mechanismen zur Steigerung der Zuverlässigkeit und Konsistenz​

Fortgeschrittene Funktionen sowie Individuelle Anpassungen

  • Entwicklung maßgeschneiderter Kataloge und Datenregister
  • Erweiterung des Funktionsumfangs durch spezielle Module
  • Konfiguration von individuellen Katalogen sowie Ausbau der Systemfunktionen​

Governance, Verwaltung und Datenschutzkonformität

  • Formulierung und Umsetzung verbindlicher Regeln zur Datenverwaltung
  • Einhaltung relevanter gesetzlicher Vorgaben im Datenschutzbereich
  • Erfassung von Zugriffsprotokollen und Nachvollziehbarkeit der Datenströme
  • Absicherung der Datenqualität und Einhaltung gesetzlicher Anforderungen​

Zusammenfassung sowie zukünftige Entwicklungsschritte

Voraussetzungen

  • Grundkenntnisse über Kernkonzepte, grundlegende Operationen sowie das Management von Apache-Iceberg-Tabellen

Zielgruppe

  • Dateningenieure
  • Datenarchitekten
  • Datenanalysten
  • Softwareentwickler
 21 Stunden

Teilnehmerzahl


Preis je Teilnehmer (exkl. USt)

Erfahrungsberichte (2)

Kommende Kurse

Verwandte Kategorien