Après avoir suivi ces cours, je me sens confiant dans la création de visualisations et de tableaux de bord professionnels.
Description du cours
Comprendre les bases de l'ingénierie des données
Dans ce cours, vous découvrirez les principales responsabilités d'un ingénieur des données, en quoi elles diffèrent de celles d'un scientifique des données et comment elles facilitent le flux de données au sein d'une organisation. Grâce à des exercices pratiques, vous suivrez Spotflix, une société fictive de diffusion de musique en continu, pour comprendre comment ses ingénieurs de données collectent, nettoient et cataloguent leurs données.
Appliquer dans les cas personnels
À la fin de la formation, vous comprendrez ce que font les ingénieurs en données de votre entreprise, vous serez prêt à discuter avec un ingénieur en données et vous disposerez d'une base solide pour entamer votre propre parcours d'ingénieur en données.
Prérequis
Ce cours ne requiert aucun prérequis.
Programme de formation
Plan du cours
1
Qu’est-ce que l’ingénierie des données ?
Dans ce chapitre, vous allez apprendre ce qu’est l’ingénierie des données et pourquoi la demande en la matière est en augmentation. Vous découvrirez ensuite où se situe l’ingénierie des données dans le cycle de vie de la science des données, en quoi les ingénieurs de données diffèrent des data scientists, et vous découvrirez votre premier pipeline de données complet.
2
Stockage des données
Il est temps de parler du stockage des données, l’une des principales responsabilités de l’ingénieur de données. Dans ce chapitre, vous apprendrez comment les ingénieurs de données gèrent différentes structures de données, travaillent avec le SQL, le langage de programmation privilégié pour l'interrogation et le stockage des données, et mettent en œuvre des solutions de stockage de données appropriées avec les lacs de données et les entrepôts de données.
3
Déplacement et traitement des données
Les ingénieurs de données facilitent la vie des data scientists : à l’aide de différentes techniques de traitement, ils leur préparent les données brutes pour l’analyse en différentes étapes. Ces étapes doivent être combinées pour créer des pipelines, et c’est là que l’automatisation entre en jeu. Enfin, les ingénieurs de données utilisent le parallélisme et le cloud pour assurer la fluidité des pipelines.
R
Présentation de l’ingénierie des données
Cours
terminé

