Build your ultimate AI agent
Descripción del curso
Saber construir herramientas capaces de recuperar y analizar información almacenada en Internet ha sido y sigue siendo un proceso valioso en muchos aspectos de la ciencia de datos. En este curso, aprenderás a navegar y analizar código html, además de a construir herramientas para rastrear sitios web automáticamente. Aunque nuestro scraping se realizará utilizando la versátil biblioteca Scrapy de Python, muchas de las técnicas que aprenderás en este curso pueden aplicarse también a otras bibliotecas populares de Python, como BeautifulSoup o Selenium. Al finalizar este curso, tendrás un sólido modelo mental de lo que es la estructura html, podrás construir herramientas para analizar código html y acceder a la información deseada, y crearás una sencilla araña scrapy para rastrear la web a escala.
Requisitos previos
Programa de formación
Contenido del curso
1
Introducción a HTML
Aprende la estructura de HTML. Empezaremos explicando por qué el web scraping puede ser una valiosa adición a tu caja de herramientas de la ciencia de datos y luego profundizaremos en algunos aspectos básicos de HTML. Terminamos el capítulo con una breve introducción sobre la notación XPath, que se utiliza para navegar por los elementos dentro del código HTML.
- Visión general del web scraping50 XP
- ¡El web scraping no es ninguna tontería!50 XP
- HyperText Markup Language50 XP
- Navegación detallada por el árbol HTML50 XP
- De árbol a HTML100 XP
- Atributos50 XP
- Con clase100 XP
- Búsqueda de href50 XP
- Curso intensivo de XPath50 XP
- ¿Dónde estoy?100 XP
- Ha llegado la hora de P100 XP
- Span con clase100 XP
2
XPaths y selectores
Aprovecha la sintaxis de XPath de para explorar los selectores scrapy. Ambos conceptos te llevarán a ser capaz de hacer scraping a un documento de HTML.
3
Localizadores CSS, encadenamiento y respuestas
Aprende la sintaxis de los localizadores CSS y empieza a jugar con la idea de encadenar localizadores CSS con XPath. También se presentan los objetos Respuesta, que se comportan como selectores, pero nos proporcionan herramientas adicionales para movilizar nuestro esfuerzo de scraping en varios sitios web.
4
Arañas
Aprende a crear arañas web con scrapy. Estas arañas scrapy rastrearán varias páginas de Internet, siguiendo enlaces para hacer scraping automáticamente cada una de esas páginas según los procedimientos que hemos aprendido en los capítulos anteriores.
Web scraping en Python
Curso
completado

