メインコンテンツにスキップ

トラック

強化学習 Pythonで

強化学習(RL)の基礎を習得し、複雑な現実世界の環境をナビゲートできるモデルやLLMをトレーニングできるようになります。

  • Python
  • 機械学習
  • 12 hr
  • 4,520

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?法人向けプランを試す

トラック概要

強化学習 Pythonで

強化学習(RL)の基礎を習得し、ロボティクスやビデオゲームでよく見られる複雑な環境を攻略するモデルの構築方法を学びます。強化学習が初めての方や、機械学習の一分野として強化学習を専門的に学びたい方にとって、ここは最適な出発点です。まず、マルコフ決定過程、探索と活用のトレードオフ、動的計画法アルゴリズムなど、強化学習の基本概念を学びます。 Gymnasiumライブラリの山岳地帯や凍った湖を進むために、Q学習、SARSA、その他の手法を適用する方法を学びます。深層学習と強化学習を組み合わせ、ほとんど監督なしでエージェントを訓練して非常に複雑な環境を移動させるために使える深層強化学習を学びます。その過程で、これらの手法を実際のプロジェクトに適用し、タクシーのルート最適化や株式取引シミュレーションなどに取り組みます。これらの強化学習ツールがあれば、強化学習の新たな刺激的な応用である人間のフィードバックからの強化学習(RLHF)に取り組み始める準備が整います。 RLHFは、人間のフィードバックをもとに応答を学習させることで、LLMの出力を改善するために使用できます。強化学習の旅を今日始めましょう!

前提条件

このトラックに受講要件はありません

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。