Sari la conținutul principal

Urmărește

Big Data cu PySpark

Stăpânește procesarea datelor mari și valorifică-le eficient cu Apache Spark folosind API-ul PySpark.

  • Python
  • Importarea și curățarea datelor
  • 25 hr
  • 10,146

Creează-ți contul gratuit

Continuă cu Google
sau
Continuând, accepți Termenii de utilizare, Politica de confidențialitate și faptul că datele tale sunt stocate în SUA.

Apreciat de cursanți din mii de companii

Instruiești o echipă?Încearcă pentru companii

Descrierea traseului

Big Data cu PySpark

Îți avansezi abilitățile de date stăpânind Apache Spark. Folosind API-ul Spark Python, PySpark, vei valorifica calculul paralel cu seturi mari de date și te vei pregăti pentru machine learning de înaltă performanță. De la curățarea datelor la crearea de caracteristici și implementarea modelelor de învățare automată, vei executa fluxuri de lucru end-to-end cu Spark. Calea se încheie cu construirea unui motor de recomandări folosind popularul set de date MovieLens și setul de date Million Songs.

Cerințe prealabile

Nu există prerequisite pentru acest traseu

Dezvoltă-ți competențele în date cu DataCamp for Mobile

Fă progrese din mers cu cursurile noastre pentru mobil și provocările zilnice de programare de 5 minute.