メインコンテンツへスキップ

コース

PySpark でデータをクレンジングする

上級4 時間

PythonでApache Sparkを使い、データのクリーニング手法を学びます。

Python4 時間16 本の動画53 個の演習4,150 XP33,454修了証明書

無料アカウントを作成

Google で続行
または
続行することで、 利用規約、私たちの プライバシーポリシー そして、あなたのデータが米国に保存されること。

何千もの企業の学習者に支持されています

チームのトレーニングをお考えですか?

ビジネス向けに試す

コース説明

データを扱うのは難しいものです。ましてや数百万、数十億行規模となるとさらに大変です。 きれいなデータを前提にノートPC上で書かれたデータ処理コードを受け取りましたか? おそらく、プロトタイプのデータ処理を本番へ移行する役割を任されたことがあるのではないでしょうか。 欠損値や奇妙な書式、そして桁違いのデータ量を含む実世界のデータセットに取り組んだことがあるかもしれません。これが初めてでも、このコースでは、Apache Spark と Python を使ってデータ処理を準備するために必要なことを学べます。 用語、手法、そして高性能で保守しやすく、理解しやすいデータ処理基盤を作るためのベストプラクティスを学習します。

前提条件

カリキュラム

コース概要

PySpark でデータをクレンジングする

コース修了

達成証明書を取得する

今すぐ登録

DataCamp for Mobileでデータスキルを磨きましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進めましょう。

PySpark でデータをクレンジングする | DataCamp