メインコンテンツへスキップ

コース

Rで学ぶ特徴量エンジニアリング

中級4 時間

機械学習モデルの特徴量エンジニアリングの原則と、Rのtidymodelsでの実装方法を学びます。

R4 時間14 本の動画58 個の演習4,950 XP2,662修了証明書

無料アカウントを作成

Google で続行
または
続行することで、 利用規約、私たちの プライバシーポリシー そして、あなたのデータが米国に保存されること。

何千もの企業の学習者に支持されています

チームのトレーニングをお考えですか?

ビジネス向けに試す

コース説明

前提条件

カリキュラム

コース概要

2

特徴量の変換

この章では、手作業での変換にとどまらず、tidyverse のツールを活用してプログラム的に新しい変数を作成できることを学びます。こうしたアプローチがモデルの再現性を高め、特に多くの特徴量を含むデータセットを扱う際に有用であることを確認します。
3

特徴量の抽出

この章では、高次元データから次元を削減し、特徴量を抽出することがモデルに有益である場面を学びます。具体的には、テキストデータを数値に変換する方法、カテゴリデータのエンコーディング、変数の予測力の順位付けなどを扱います。主成分分析、カーネル主成分分析、テキストからの数値抽出、カテゴリカル・エンコーディング、変数重要度スコアといった手法を探究します。
4

特徴量の選択

このコースの締めくくりとして、特徴量エンジニアリングと Machine Learning の手法を学びます。まず、利用可能なすべての特徴量をモデルに使うことによる問題点に着目し、無関係・冗長な特徴量を見極めて除去する重要性、そして lasso や elastic-net のような埋め込み法でそれを行う方法を学びます。次に、lasso、ridge、elastic-net などの縮小法を取り上げ、係数の正則化や、係数をゼロにして特徴量選択を行う手法を学びます。最後に、エンドツーエンドの特徴量エンジニアリングのワークフローを構築し、これまで学んだ概念や関数を小さなプロジェクトで復習・実践して締めくくります。
R

Rで学ぶ特徴量エンジニアリング

コース修了

達成証明書を取得する

今すぐ登録

DataCamp for Mobileでデータスキルを磨きましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進めましょう。