Zum Hauptinhalt springen

Kurs

Daten­transformation mit Spark SQL in Databricks

Mittelstufe3 Std.

End-to-end-Daten-Pipelines bauen – von Bereinigung und Aggregation bis zu Streaming und Orchestrierung.

Python3 Std.7 Videos25 Übungen1,750 XP1,825Leistungsnachweis

Erstelle dein kostenloses Konto

Mit Google fortfahren
oder
Wenn du fortfährst, akzeptierst du unsere Nutzungsbedingungen, unsere Datenschutzrichtlinie und dass deine Daten in den USA gespeichert werden.

Beliebt bei Lernenden in tausenden Unternehmen

Du bildest ein Team weiter?

Für Unternehmen testen →

Kursbeschreibung

Bereit, reale Daten im großen Stil zu verarbeiten? In diesem Kurs lernst du, große Datensätze mit Spark SQL und PySpark in Databricks zu transformieren. Du formst und bereinigst Daten, führst Aggregationen mit optimierten Joins aus und nutzt Window-Funktionen für erweiterte Analysen. Außerdem richtest du dateibasierte Streams mit fehlertoleranten Checkpoints ein und speicherst Ergebnisse als Delta-Tabellen. Am Ende orchestrierst du mehrstufige Produktions-Pipelines mit Databricks Workflows und Lakeflow Declarative Pipelines.

Voraussetzungen

Lernprogramm

Kursübersicht

Daten­transformation mit Spark SQL in Databricks

Kurs
abgeschlossen

Leistungsnachweis verdienen

Jetzt einschreiben

Erweitere deine Datenkompetenzen mit DataCamp for Mobile

Mach Fortschritte unterwegs – mit unseren mobilen Kursen und den täglichen 5-minütigen Coding-Challenges.