Przejdź do głównej treści

Ścieżka

Big Data z PySpark

Opanuj przetwarzanie dużych zbiorów danych i efektywne wykorzystywanie ich z Apache Spark przy użyciu API PySpark.

  • Python
  • Importowanie i czyszczenie danych
  • 25 godz.
  • 9,690

Utwórz bezpłatne konto

Kontynuuj z Google
lub
Kontynuując, akceptujesz nasz Warunki użytkowania, nasz Polityka prywatności i że Twoje dane są przechowywane w USA.

Uwielbiany przez uczących się w tysiącach firm

Szkolisz zespół?Wypróbuj dla firm

Opis ścieżki

Big Data z PySpark

Rozwiń swoje umiejętności pracy z danymi, opanowując Apache Spark. Korzystając z interfejsu Spark Python API, PySpark, wykorzystasz obliczenia równoległe na dużych zbiorach danych i przygotujesz się do wydajnego uczenia maszynowego. Od czyszczenia danych po tworzenie cech i wdrażanie modeli uczenia maszynowego, będziesz realizować kompleksowe przepływy pracy z użyciem Spark. Ścieżka kończy się zbudowaniem silnika rekomendacji przy użyciu popularnego zbioru danych MovieLens oraz zbioru danych Million Songs.

Wymagania wstępne

Ta ścieżka nie ma wymagań wstępnych

Rozwijaj swoje umiejętności danych z DataCamp for Mobile

Rozwijaj się w drodze dzięki naszym kursom mobilnym i codziennym 5-minutowym wyzwaniom kodowania.