Pular para o conteúdo principal

Programa

Big Data com PySpark

Aprenda a processar big data e aproveitá-lo de forma eficiente com o Apache Spark usando a API PySpark.

  • Python
  • Importação e limpeza de dados
  • 25 hr
  • 10,139

Crie sua conta gratuita

Continuar com o Google
ou
Ao continuar, você aceita nossa Termos de Uso, nossos Política de Privacidade e que seus dados são armazenados nos EUA.

Amado por alunos em milhares de empresas

Treinando uma equipe?Experimente para Empresas

Descrição da trilha

Big Data com PySpark

Para aprimorar suas habilidades com dados, você deve dominar o Apache Spark. Usando a API Python do Spark, PySpark, você aproveitará a computação paralela com grandes conjuntos de dados e se preparará para o machine learning de alto desempenho. Desde a limpeza de dados até a criação de recursos e a implementação de modelos de machine learning, você executará fluxos de trabalho de ponta a ponta com o Spark. O programa termina com a criação de um mecanismo de recomendação usando o popular conjunto de dados MovieLens e o conjunto de dados Million Songs.

Pré-requisitos

Essa trilha não tem pré-requisitos

Desenvolva suas habilidades em dados com o DataCamp para Mobile

Progrida onde estiver com nossos cursos no celular e desafios diários de programação de 5 minutos.