Weiter zum Inhalt

Kostenloser Kurs

Daten­transformation mit Spark SQL in Databricks

Mittelstufe3 Std.

End-to-end-Daten-Pipelines bauen – von Bereinigung und Aggregation bis zu Streaming und Orchestrierung.

Python3 Std.7 Videos25 Übungen1,750 XP1,242Leistungsnachweis

Erstelle dein kostenloses Konto

Mit Google fortfahren
oder
Indem du fortfährst, akzeptierst du unsere Nutzungsbedingungen, unser Datenschutzrichtlinie und dass Ihre Daten in den USA gespeichert werden.

Geliebt von Lernenden in Tausenden Unternehmen

Kursbeschreibung

Bereit, reale Daten im großen Stil zu verarbeiten? In diesem Kurs lernst du, große Datensätze mit Spark SQL und PySpark in Databricks zu transformieren. Du formst und bereinigst Daten, führst Aggregationen mit optimierten Joins aus und nutzt Window-Funktionen für erweiterte Analysen. Außerdem richtest du dateibasierte Streams mit fehlertoleranten Checkpoints ein und speicherst Ergebnisse als Delta-Tabellen. Am Ende orchestrierst du mehrstufige Produktions-Pipelines mit Databricks Workflows und Lakeflow Declarative Pipelines.

Voraussetzungen

Lernprogramm

Kursübersicht

Daten­transformation mit Spark SQL in Databricks

Kurs
abgeschlossen

Bescheinigung über den Abschluss erhalten

Jetzt einschreiben

Datenkompetenz für unterwegs – mit der DataCamp-App

Mit unseren Kursen für Mobilgeräte und täglichen Programmier-Challenges erweiterst du deine Datenkompetenz von unterwegs.