Schulungsübersicht
Einführung in Apache Spark
- Die Rolle von Spark bei der Verarbeitung großer Datenmengen
- Architektur von Spark sowie seine wichtigsten Komponenten
Einrichtung von Apache Spark
- Erforderliche Hardware- und Softwarevoraussetzungen
- Installationsverfahren im Einzel- und Cluster-Modus
- Bewährte Konfigurationsmethoden für Systemadministratoren
Verwaltung von Spark-Clustern
- Werkzeuge und Techniken zur Cluster-Verwaltung
- Überwachung von Spark-Anwendungen sowie Verbrauch der Ressourcen
- Sicherheitskonfigurationen und Benutzerverwaltung
Performance-Tuning und Optimierung
- Ressourcenzuweisung und Planung von Prozessen
- Optimierungsmöglichkeiten zur Steigerung der Leistung von Spark
- Identifizierung sowie Behebung häufiger Engpässe
Fehlerbehebung und Problemlösung
- Häufige Herausforderungen bei der Verwaltung von Spark
- Diagnosewerkzeuge sowie Methoden zur Fehlersuche
- Systematische Vorgehensweise bei der Lösung typischer Probleme
- Bewährte Praktiken für ein stabiles und leistungsfähiges Spark-Umfeld
Fortgeschrittene Verwaltungsthemen
- Integration mit anderen Big-Data-Tools
- Sicherstellung hoher Verfügbarkeit sowie Notfallwiederherstellung<
- Aktualisierung und Skalierung von Spark-Clustern<
Zusammenfassung und weitere Schritte
Voraussetzungen
- Grundkenntnisse in der Netzwerkkonfiguration und -verwaltung
- Vertrautheit mit dem Linux-Betriebssystem sowie der Kommandozeile
- Interesse an verteilten Rechensystemen sowie am Umgang mit Big Data
Zielgruppe
- Systemadministratoren
Erfahrungsberichte (3)
Eine Reise durch die Spark-Welt: ein sehr intensiver Kurs. DSL, Spark SQL, Partitionierung versus Bucketing für mich.
Georgiana Elisabeta
Kurs - Apache Spark Fundamentals
Maschinelle Übersetzung
Ich mochte es, dass es praktisch war. Ich liebte es, die theoretischen Kenntnisse mit praktischen Beispielen anzuwenden.
Aurelia-Adriana - Allianz Services Romania
Kurs - Python and Spark for Big Data (PySpark)
Maschinelle Übersetzung
Die Tatsache, dass wir die meisten Informationen, Kurse, Präsentationen und Übungen mitnehmen konnten, sodass wir sie noch einmal durchgehen und eventuell das Wiederholen können, was wir beim ersten Mal nicht verstanden haben, oder das Verbessern, was wir bereits gemacht haben.
Raul Mihail Rat - Accenture Industrial SS
Kurs - Python, Spark, and Hadoop for Big Data
Maschinelle Übersetzung