Przejdź do głównej treści

Kurs

Data Transformation with Spark SQL in Databricks

Średniozaawansowany3 godz.

Buduj kompleksowe potoki danych — od czyszczenia i agregacji po streaming i orkiestrację.

Python3 godz.7 filmy25 ćwiczeń1,750 XP1,525Zaświadczenie o ukończeniu

Utwórz bezpłatne konto

Kontynuuj z Google
lub
Kontynuując, akceptujesz nasz Warunki użytkowania, nasz Polityka prywatności i że Twoje dane są przechowywane w USA.

Uwielbiany przez kursantów z tysięcy firm

Szkolisz zespół?

Wypróbuj dla firm

Opis kursu

Chcesz przetwarzać dane na dużą skalę w rzeczywistych projektach? Ten kurs uczy, jak przekształcać duże zbiory danych za pomocą Spark SQL i PySpark w Databricks. Nauczysz się kształtować i czyścić dane, wykonywać agregacje z optymalnymi złączeniami oraz stosować funkcje okna do zaawansowanej analizy. Skonfigurujesz też strumieniowanie plikowe z odpornymi na błędy punktami kontrolnymi i zapiszesz wyniki jako tabele Delta. Na koniec będziesz orkiestrować wieloetapowe potoki produkcyjne przy użyciu Databricks Workflows i Lakeflow Declarative Pipelines.

Wymagania wstępne

Program nauczania

Plan kursu

Data Transformation with Spark SQL in Databricks

Kurs
ukończony

Zdobądź zaświadczenie o ukończeniu

Zapisz się teraz

Rozwijaj swoje umiejętności danych z DataCamp for Mobile

Rozwijaj się w drodze dzięki naszym kursom mobilnym i codziennym 5-minutowym wyzwaniom kodowania.