Vai al contenuto principale

Corso

Trasformazione dei dati con Spark SQL in Databricks

Intermedio3 h

Crea pipeline dati end-to-end: da pulizia e aggregazione a streaming e orchestrazione.

Python3 h7 video25 esercizi1,750 XP1,520Attestato di completamento

Crea il tuo account gratuito

Continua con Google
oppure
Continuando, accetti la nostra Termini di utilizzo, i nostri Informativa sulla privacy e il fatto che i tuoi dati sono archiviati negli USA.

Scelto dagli studenti di migliaia di aziende

Descrizione del corso

Pronto a gestire dati reali su larga scala? In questo corso imparerai a trasformare grandi insiemi di dati usando Spark SQL e PySpark in Databricks. Impara a modellare e pulire i dati, eseguire aggregazioni con join ottimizzati e applicare window function per analisi avanzate. Imposterai anche lo streaming basato su file con checkpoint tolleranti ai guasti e persisterai i risultati come tabelle Delta. Al termine, orchestrerai pipeline di produzione multi-step con Databricks Workflows e Lakeflow Declarative Pipelines.

Prerequisiti

Programma

Struttura del corso

1

Caricamento e modellazione dei dati

Trasformazione dei dati con Spark SQL in Databricks

Corso
completato

Ottieni Attestato di conseguimento

Iscriviti ora

Sviluppa le tue competenze sui dati con DataCamp for Mobile

Fai progressi ovunque tu sia con i nostri corsi mobile e le sfide di programmazione quotidiane da 5 minuti.