Build your ultimate AI agent
コース説明
TreeベースのMachine Learningモデルは、データに潜む複雑な非線形関係を捉え、Machine Learningコンペティションでも高い成績を収めることで知られています。本コースでは、tidymodelsパッケージを使って、シンプルな決定木から高度なランダムフォレストまで、さまざまなTreeベースのモデルを探索・構築します。さらに、アンサンブル学習で高性能な予測モデルを実現する強力な手法である勾配ブースティング(boosted trees)の使い方も学びます。過程では、糖尿病の発症や顧客離脱を予測するために、ヘルスデータや与信リスクデータを扱います。
前提条件
カリキュラム
コース概要
1
分類木
実践的なMachine Learningパイプラインを構築する準備はできましたか?手を動かしながら、決定木の作成、データ分割、そしてどの患者が糖尿病を発症しやすいかを予測する方法を学びます。最後に、モデルを評価して予測を判断するための性能指標も作成します。
2
回帰木とクロスバリデーション
甘い題材で回帰に挑戦しましょう。チョコレートの評価データセットを使って回帰木を構築し、適切な誤差指標で性能を評価します。クロスバリデーションといった“スイート”な手法を適用して、単一の学習/テスト分割に伴う統計的不安定性を克服し、さらに一歩進んでバイアス・バリアンスのトレードオフを深く理解します。
3
ハイパーパラメータとアンサンブルモデル
ハイパーパラメータのチューニングとROC(受信者動作特性)曲線の解釈を本格的に行います。この章では、バギングやランダムフォレストなどのアンサンブルモデルで“集合知”を活用し、どのクレジットカード顧客が離脱しやすいかを予測するアンサンブルを構築します。
4
ブースティング木
Treeベースモデルのハイレベルな世界へようこそ。勾配ブースティングを用いて、これまで見たどのモデルよりも高性能なアンサンブルを作成します。微調整の方法を学び、複数モデルを比較して本番投入に最適なモデルを選びましょう。
R
Rで学ぶTree-Based ModelsによるMachine Learning
コース修了

