メインコンテンツにスキップ

コース

PySpark でデータをクレンジングする

上級4 時間

PythonでApache Sparkを使い、データのクリーニング手法を学びます。

Python4 時間動画 16 本演習 53 件4,150 XP33,700修了証明書

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?

法人向けプランを試す

コースの説明

データを扱うのは難しいものです。ましてや数百万、数十億行規模となるとさらに大変です。 きれいなデータを前提にノートPC上で書かれたデータ処理コードを受け取りましたか? おそらく、プロトタイプのデータ処理を本番へ移行する役割を任されたことがあるのではないでしょうか。 欠損値や奇妙な書式、そして桁違いのデータ量を含む実世界のデータセットに取り組んだことがあるかもしれません。これが初めてでも、このコースでは、Apache Spark と Python を使ってデータ処理を準備するために必要なことを学べます。 用語、手法、そして高性能で保守しやすく、理解しやすいデータ処理基盤を作るためのベストプラクティスを学習します。

前提条件

カリキュラム

コース概要

PySpark でデータをクレンジングする

コース修了

修了証明書を取得

今すぐ登録する

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。