メインコンテンツにスキップ

コース

Python で設計する Machine Learning ワークフロー

上級4 時間

長く使えるパイプラインの構築を学ぶ。

Python4 時間動画 16 本演習 51 件4,200 XP12,716修了証明書

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?

法人向けプランを試す

コースの説明

最新ツールのおかげで Machine Learning モデルの本番運用は簡単そうに見えますが、開発環境より本番で性能が落ちてしまい、期待外れに終わることも少なくありません。本コースでは、あなたをデータサイエンスの中で一歩抜きん出させ、時間に耐えるパイプラインを構築するための4つのスーパーパワーを身につけます。開発段階でモデルのあらゆる側面を徹底的にチューニングする方法、利用可能なドメイン知識を最大限に活用する方法、モデルを継続的に監視して性能低下に対処する方法、そしてラベルが不十分または希少なデータへの向き合い方です。sklearn の最新機能を深掘りし、パーソナライズド医療やサイバーセキュリティなどホットな分野の実データセットを扱いながら、最前線から見た Machine Learning の実像を明らかにします。

前提条件

カリキュラム

コース概要

1

標準的なワークフロー

この章では、教師あり学習ワークフローの基本を復習します。モデルの学習、チューニングと選択、特徴量エンジニアリングと選択、データ分割の手法まで一通り押さえます。ワークフロー内の各ステップが互いにどう依存し合うか、そしてそれぞれが過学習(データサイエンティストの最大の敵)を招くことも防ぐこともある点を理解します。章末には、教師あり学習に自信を持って取り組めるようになり、以降の章でより高度な内容に進む準備が整います。
2

Human-in-the-Loop

前章では、標準的な教師あり学習ワークフローの知識を磨き上げました。今章では、専門家の知見を教師あり学習に取り込む方法を批判的に検討します。これは、適切な分析単位を特定すること(複数データソースにまたがる特徴量エンジニアリングを要する場合があります)、必ずしも完璧ではないラベリングのプロセス、そして Machine Learning モデルが犯す誤りの真のビジネス価値を捉える損失関数の設計によって実現します。
3

モデルのライフサイクル管理

前章では、専門家からのフィードバックをワークフローに取り入れ、ビジネス価値に即した方法で評価しました。ここからは、モデルをプロダクションに適用し、その後も継続的に高い性能を保てるよう反復的に改善するスキルを実践します。さらに、データセットシフトを診断し、環境の変化がモデル精度に及ぼす影響を軽減する方法も学びます。
4

教師なしワークフロー

これまでの章で、教師あり学習の確かな基礎と、本番デプロイに関する知識を身につけてきましたが、常にラベル付きデータがあることを前提としていました。この章では、ラベルが全くない、あるいはごくわずかなデータを扱う課題に挑みます。これは、教師なしの手法である異常検知や、ラベルの代わりにサンプル間の類似性に関する考え方を用いる距離ベース学習へとあなたを導き、教師ありワークフローに匹敵する精度を目指します。この章を終えるころには、現実世界でよくある課題を乗り越えるためにワークフローをどう調整すべきか、適切なツールを自信を持って選べるデータサイエンティストとして一段と際立つ存在になっています。

Python で設計する Machine Learning ワークフロー

コース修了

修了証明書を取得

今すぐ登録する

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。