Accéder au contenu principal

Cours

Web scraping en R

Intermédiaire4 h

Apprenez à collecter et télécharger efficacement des données à partir de n'importe quel site web à l'aide de R.

R4 h13 vidéos45 exercices3,600 XP15,087Attestation de réussite

Créez votre compte gratuit

Continuer avec Google
ou
En continuant, vous acceptez nos Conditions d’utilisation, notre notre Politique de confidentialité et que vos données sont stockées aux États-Unis.

Plébiscité par des apprenants dans des milliers d’entreprises

Description du cours

Vous êtes déjà tombé sur un site web qui affiche beaucoup de données — statistiques, avis produits, prix — dans un format peu adapté à l’analyse de données ? Il arrive que des organismes et autres producteurs publient leurs données dans des tableaux bien structurés. Mais tous ces sites n’offrent pas un bouton de téléchargement. Pas de panique : dans ce cours, vous apprendrez à collecter et télécharger efficacement des données depuis n’importe quel site avec R. Vous verrez comment automatiser le scraping et l’analyse de pages Wikipédia avec les packages rvest et httr. À travers des exercices pratiques, vous consoliderez aussi votre compréhension de HTML et CSS, les briques de base des pages web, pour rendre vos workflows de collecte plus fiables et plus efficaces.

Prérequis

Programme de formation

Plan du cours

1

Introduction à HTML et au web scraping

Dans ce chapitre, vous découvrirez le HyperText Markup Language (HTML), un langage déclaratif utilisé pour structurer les sites web modernes. Avec la bibliothèque rvest, vous apprendrez à interroger des éléments HTML simples et à extraire votre premier tableau.
Commencer le chapitre
R

Web scraping en R

Cours
terminé

Obtenir un certificat d'achèvement

S’inscrire maintenant

Apprenez où que vous soyez avec l'application DataCamp

Même en déplacement, suivez quotidiennement nos cours mobiles et nos défis de codage de 5 minutes.