Accéder au contenu principal

Cours gratuit

Transformation des données avec Spark SQL dans Databricks

Intermédiaire3 h

Construisez des pipelines de données de bout en bout, du nettoyage et de l’agrégation au streaming et à l’orchestration.

Python3 h7 vidéos25 exercices1,750 XP1,242Attestation de réussite

Créez votre compte gratuit

Continuer avec Google
ou
En continuant, vous acceptez nos Conditions d’utilisation, notre notre Politique de confidentialité et que vos données sont stockées aux États-Unis.

Plébiscité par des apprenants dans des milliers d’entreprises

Description du cours

Prêt à traiter des données réelles à grande échelle ? Ce cours vous apprend à transformer de vastes jeux de données avec Spark SQL et PySpark dans Databricks. Vous apprendrez à façonner et nettoyer les données, à exécuter des agrégations avec des jointures optimisées, et à appliquer des fonctions de fenêtre pour des analyses avancées. Vous configurerez aussi un streaming basé sur des fichiers avec des points de contrôle tolérants aux pannes et vous conserverez les résultats sous forme de tables Delta. À la fin, vous orchestrerez des pipelines de production en plusieurs étapes avec Databricks Workflows et Lakeflow Declarative Pipelines.

Prérequis

Programme de formation

Plan du cours

1

Chargement et mise en forme des données

Transformation des données avec Spark SQL dans Databricks

Cours
terminé

Obtenir un certificat d'achèvement

S’inscrire maintenant

Apprenez où que vous soyez avec l'application DataCamp

Même en déplacement, suivez quotidiennement nos cours mobiles et nos défis de codage de 5 minutes.