Sari la conținutul principal

Traseu de învățare

Big Data cu PySpark

Stăpânește procesarea datelor mari și valorifică-le eficient cu Apache Spark folosind API-ul PySpark.

  • Python
  • Importarea și curățarea datelor
  • 25 h
  • 9,651

Creează-ți contul gratuit

Continuă cu Google
sau
Continuând, accepți Termeni de utilizare, al nostru Politica de confidențialitate și că datele tale sunt stocate în SUA.

Iubit de cursanți din mii de companii

Formare pentru o echipă?Încearcă pentru afaceri

Descrierea traseului

Big Data cu PySpark

Îți avansezi abilitățile de date stăpânind Apache Spark. Folosind API-ul Spark Python, PySpark, vei valorifica calculul paralel cu seturi mari de date și te vei pregăti pentru machine learning de înaltă performanță. De la curățarea datelor la crearea de caracteristici și implementarea modelelor de învățare automată, vei executa fluxuri de lucru end-to-end cu Spark. Calea se încheie cu construirea unui motor de recomandări folosind popularul set de date MovieLens și setul de date Million Songs.

Cerințe prealabile

Nu există prerequisite pentru acest traseu

Dezvoltă-ți competențele în date cu DataCamp pentru mobil

Progresează oricând cu cursurile noastre mobile și provocările zilnice de programare de 5 minute.