Ir al contenido principal

Curso

Web scraping en Python

Intermedio4 h

Aprende a recuperar y a analizar información de Internet utilizando la biblioteca Scrapy de Python.

Python4 h17 vídeos56 ejercicios4,500 XP93,514Certificado de logro

Crea tu cuenta gratis

Continuar con Google
o
Al continuar, aceptas nuestros los Términos de uso, nuestro la Política de privacidad y que tus datos se almacenan en EE. UU.

Les encanta a estudiantes de miles de empresas

¿Formando a un equipo?

Prueba para empresas

Descripción del curso

Saber construir herramientas capaces de recuperar y analizar información almacenada en Internet ha sido y sigue siendo un proceso valioso en muchos aspectos de la ciencia de datos. En este curso, aprenderás a navegar y analizar código html, además de a construir herramientas para rastrear sitios web automáticamente. Aunque nuestro scraping se realizará utilizando la versátil biblioteca Scrapy de Python, muchas de las técnicas que aprenderás en este curso pueden aplicarse también a otras bibliotecas populares de Python, como BeautifulSoup o Selenium. Al finalizar este curso, tendrás un sólido modelo mental de lo que es la estructura html, podrás construir herramientas para analizar código html y acceder a la información deseada, y crearás una sencilla araña scrapy para rastrear la web a escala.

Requisitos previos

Programa de formación

Contenido del curso

1

Introducción a HTML

Aprende la estructura de HTML. Empezaremos explicando por qué el web scraping puede ser una valiosa adición a tu caja de herramientas de la ciencia de datos y luego profundizaremos en algunos aspectos básicos de HTML. Terminamos el capítulo con una breve introducción sobre la notación XPath, que se utiliza para navegar por los elementos dentro del código HTML.
Empezar capítulo
3

Localizadores CSS, encadenamiento y respuestas

Aprende la sintaxis de los localizadores CSS y empieza a jugar con la idea de encadenar localizadores CSS con XPath. También se presentan los objetos Respuesta, que se comportan como selectores, pero nos proporcionan herramientas adicionales para movilizar nuestro esfuerzo de scraping en varios sitios web.
Empezar capítulo
4

Arañas

Aprende a crear arañas web con scrapy. Estas arañas scrapy rastrearán varias páginas de Internet, siguiendo enlaces para hacer scraping automáticamente cada una de esas páginas según los procedimientos que hemos aprendido en los capítulos anteriores.
Empezar capítulo

Web scraping en Python

Curso
completado

Obtén el certificado de logro

Inscríbete ahora

Desarrolla tus habilidades con la aplicación móvil de DataCamp

Progresa sobre la marcha con nuestros cursos móviles y desafíos diarios de 5 minutos.