メインコンテンツにスキップ

コース

PySparkで学ぶ特徴量エンジニアリング

上級4 時間

データサイエンティストが時間の70~80%を費やす、データ整理と特徴量エンジニアリングの実践を学ぶ。

Python4 時間動画 16 本演習 60 件5,000 XP17,982修了証明書

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?

法人向けプランを試す

コースの説明

現実のデータは雑然としており、その意味を見いだすのがあなたの役目です。MTCars や Iris のような玩具データセットは丁寧にキュレーション・クレンジングされていますが、それでも強力な Machine Learning アルゴリズムが意味を抽出し、予測・分類・クラスタリングに活用できるようにするには、変換が必要です。このコースでは、データサイエンティストが時間の70〜80%を費やすと言われる実務、すなわちデータ整形と特徴量エンジニアリングの泥臭い部分を扱います。データセットの規模がますます大きくなる今、PySpark を使ってこのビッグデータの課題をスケーラブルに解決していきましょう!

前提条件

カリキュラム

コース概要

3

特徴量エンジニアリング

PySparkで学ぶ特徴量エンジニアリング

コース修了

修了証明書を取得

今すぐ登録する

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。