メインコンテンツにスキップ

コース

Rで学ぶ特徴量エンジニアリング

中級4 時間

機械学習モデルの特徴量エンジニアリングの原則と、Rのtidymodelsでの実装方法を学びます。

R4 時間動画 14 本演習 58 件4,950 XP2,694修了証明書

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?

法人向けプランを試す

コースの説明

前提条件

カリキュラム

コース概要

2

特徴量の変換

この章では、手作業での変換にとどまらず、tidyverse のツールを活用してプログラム的に新しい変数を作成できることを学びます。こうしたアプローチがモデルの再現性を高め、特に多くの特徴量を含むデータセットを扱う際に有用であることを確認します。
3

特徴量の抽出

この章では、高次元データから次元を削減し、特徴量を抽出することがモデルに有益である場面を学びます。具体的には、テキストデータを数値に変換する方法、カテゴリデータのエンコーディング、変数の予測力の順位付けなどを扱います。主成分分析、カーネル主成分分析、テキストからの数値抽出、カテゴリカル・エンコーディング、変数重要度スコアといった手法を探究します。
4

特徴量の選択

このコースの締めくくりとして、特徴量エンジニアリングと Machine Learning の手法を学びます。まず、利用可能なすべての特徴量をモデルに使うことによる問題点に着目し、無関係・冗長な特徴量を見極めて除去する重要性、そして lasso や elastic-net のような埋め込み法でそれを行う方法を学びます。次に、lasso、ridge、elastic-net などの縮小法を取り上げ、係数の正則化や、係数をゼロにして特徴量選択を行う手法を学びます。最後に、エンドツーエンドの特徴量エンジニアリングのワークフローを構築し、これまで学んだ概念や関数を小さなプロジェクトで復習・実践して締めくくります。
R

Rで学ぶ特徴量エンジニアリング

コース修了

修了証明書を取得

今すぐ登録する

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。