Saltar al contenido principal

Curso

Fundamentos de PySpark

Intermedio4 h

Aprende a implementar la gestión de datos distribuidos y el machine learning en Spark utilizando el paquete PySpark.

Python4 h45 ejercicios3,850 XP150K+Certificado de logro

Crea tu cuenta gratuita

Continuar con Google
o
Al continuar, aceptas nuestra Términos de uso, nuestros Política de privacidad y que tus datos se almacenen en EE. UU.

La eligen estudiantes de miles de empresas

¿Formas a un equipo?

Prueba para empresas

Descripción del curso

En este curso, aprenderás a utilizar Spark desde Python. Spark es una herramienta para realizar computación paralela con grandes conjuntos de datos y se integra bien con Python. PySpark es el paquete de Python que hace que se produzca la magia. Utilizarás este paquete para trabajar con datos sobre vuelos que viajan desde Portland y Seattle. Aprenderás a organizar estos datos y a construir todo un pipeline de machine learning para prever si dichos vuelos van a retrasarse o no. Prepárate para poner un poco de Spark en tu código Python y sumergirte en el mundo del machine learning de alto rendimiento.

Requisitos previos

Programa de formación

Esquema del curso

3

Introducción a las canalizaciones de machine learning

Fundamentos de PySpark

Curso
completado

Obtener certificado de logros

Inscríbete ahora

Desarrolla tus habilidades en datos con DataCamp para móviles

Avanza estés donde estés con nuestros cursos para móvil y retos de programación diarios de 5 minutos.