Schulungsübersicht
Einführung in Apache Iceberg
- Überblick über Apache Iceberg
- Wiederholung der grundlegenden Konzepte
Vertiefung in die Architektur von Apache Iceberg
- Detaillierte Analyse des Tabellenformats von Apache Iceberg
- Ausführliche Erläuterung der Gesamtarchitektur, einschließlich Metadatenverwaltung und Dateistruktur
- Hintergründe zur Entwicklung von Schemas sowie zu Partitionierungseinstellungen
Fortgeschrittene Installation und Konfiguration
- Einstellung der optimalen Leistung von Apache Iceberg in verschiedenen Umgebungen
- Integration mit mehreren gängigen Datenverarbeitungstools
- Erweiterte Konfigurationen: Sicherheit, Verschlüsselung und Zugriffskontrolle
- Aufbau von Apache Iceberg in einem verteilten Netzwerkumfeld
Fortgeschrittene Verwaltungs- und Wartungstechniken
- Verwaltung sehr großer Apache-Iceberg-Tabellen
- Implementierung sowie Handhabung komplexer Schemaänderungen
- Bearbeitung von Änderungen bei der Partitionierung und versteckten Aufteilungsregeln
- Fortgeschrittene CRUD-Operationen mit aktualisierten Schemas sowie Partitionierungen
Techniken zur Abfrageoptimierung
- Methoden zur Verkürzung der Laufzeit von Datenabfragen
- Pruning von Partitionen sowie Auswahl relevanter Dateien
- Caching und Optimierung des Metadatenmanagements
- Anwendung und Test der Abfrageoptimierungsverfahren
Leistungsoptimierung bei umfangreichen Datensätzen
- Effiziente Verarbeitung sehr großer Datenmengen durch gezielte Anpassungen
- Nutzung der internen Tools von Apache Iceberg zur Leistungssteigerung
- Praxisbeispiele erfolgreicher Optimierungsmaßnahmen in echten Projekten
- Anpassung der Systemeinsstellung bei großen Datenvolumina
Fortgeschrittene Migration und Integration von Daten
- Übertragung komplexer Datenstrukturen aus anderen Systemen nach Apache Iceberg
- Einbindung kontinuierlich fließender Echtzeitdaten in die Plattform
- Komplette Migration komplexer Datensammlungen sowie deren Integration mit Live-Datenflüssen
Zuverlässigkeit und Datentreue
- Sicherstellung der Integrität sowie Konsistenz von Daten in verteilten Netzwerken
- Einführung transaktionaler Regeln zur Garantie der Datentreue
- Systematischer Umgang mit Fehlfunktionen sowie automatisierte Wiederherstellungsschritte
- Implementierung von Mechanismen zur Steigerung der Zuverlässigkeit und Konsistenz
Fortgeschrittene Funktionen sowie Individuelle Anpassungen
- Entwicklung maßgeschneiderter Kataloge und Datenregister
- Erweiterung des Funktionsumfangs durch spezielle Module
- Konfiguration von individuellen Katalogen sowie Ausbau der Systemfunktionen
Governance, Verwaltung und Datenschutzkonformität
- Formulierung und Umsetzung verbindlicher Regeln zur Datenverwaltung
- Einhaltung relevanter gesetzlicher Vorgaben im Datenschutzbereich
- Erfassung von Zugriffsprotokollen und Nachvollziehbarkeit der Datenströme
- Absicherung der Datenqualität und Einhaltung gesetzlicher Anforderungen
Zusammenfassung sowie zukünftige Entwicklungsschritte
Voraussetzungen
- Grundkenntnisse über Kernkonzepte, grundlegende Operationen sowie das Management von Apache-Iceberg-Tabellen
Zielgruppe
- Dateningenieure
- Datenarchitekten
- Datenanalysten
- Softwareentwickler
Erfahrungsberichte (2)
Eine Reise durch die Spark-Welt: ein sehr intensiver Kurs. DSL, Spark SQL, Partitionierung versus Bucketing für mich.
Georgiana Elisabeta
Kurs - Apache Spark Fundamentals
Maschinelle Übersetzung
Praktische Übungen. Die Kursdauer sollte eigentlich fünf Tage betragen, aber die drei Tage halfen dabei, viele Fragen zu klären, die ich bei der Arbeit mit NiFi bereits hatte.
James - BHG Financial
Kurs - Apache NiFi for Administrators
Maschinelle Übersetzung