Ga naar hoofdinhoud

Volgen

Big Data met PySpark

Leer hoe je big data kunt verwerken en efficiënt kunt gebruiken met Apache Spark via de PySpark API.

  • Python
  • Importing & Cleaning Data
  • 25 hr
  • 10,154

Maak je gratis account aan

Ga verder met Google
of
Door verder te gaan, accepteer je ons Gebruiksvoorwaarden, onze Privacybeleid en dat je gegevens in de VS worden opgeslagen.

Geliefd bij lerenden bij duizenden bedrijven

Train je een team?Probeer for Business

Leerpadbeschrijving

Big Data met PySpark

Maak je datavaardigheden nog beter door Apache Spark onder de knie te krijgen. Met de Spark Python API, PySpark, kun je parallelle berekeningen uitvoeren met grote datasets en ben je helemaal klaar voor high-performance machine learning. Van het opschonen van data tot het maken van functies en het implementeren van machine learning-modellen, je doet alles met Spark. De track eindigt met het bouwen van een aanbevelingsengine met behulp van de populaire MovieLens-dataset en de Million Songs-dataset.

Vereisten

Er zijn geen vereisten voor dit Leerpad

Ontwikkel je datavaardigheden met DataCamp for Mobile

Boek onderweg vooruitgang met onze mobiele cursussen en dagelijkse coding-uitdagingen van 5 minuten.