メインコンテンツにスキップ

トラック

PySparkによるビッグデータ

Apache Spark の PySpark API を使って、データを効率的に処理し活用する方法を習得します。

  • Python
  • データのインポートとクリーニング
  • 25 hr
  • 10,129

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?法人向けプランを試す

トラック概要

PySparkによるビッグデータ

Apache Sparkを習得して、データスキルをさらに高めましょう。 Spark Python APIであるPySparkを使って、大規模データセットで並列計算を活用し、高性能な機械学習に備えます。 データのクレンジングから特徴量の作成、機械学習モデルの実装まで、Sparkを使ってエンドツーエンドのワークフローを実行します。 このトラックは、人気のMovieLensデータセットとMillion Songsデータセットを使ってレコメンデーションエンジンを構築することで締めくくられます。

前提条件

このトラックに受講要件はありません

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。