メインコンテンツへスキップ

コース

Pythonで学ぶDeep Reinforcement Learning

上級4 時間

強力な Deep Reinforcement Learning のアルゴリズムを学び、洗練・最適化手法を含めて実践します。

Python4 時間15 本の動画49 個の演習4,050 XP5,775修了証明書

無料アカウントを作成

Google で続行
または
続行することで、 利用規約、私たちの プライバシーポリシー そして、あなたのデータが米国に保存されること。

何千もの企業の学習者に支持されています

チームのトレーニングをお考えですか?

ビジネス向けに試す

コース説明

前提条件

カリキュラム

コース概要

3

Policy Gradient手法の基礎

DRLにおけるpolicy gradient手法の基礎概念を学びます。まず、これらの手法の土台となるpolicy gradient定理から始めます。次に、方策学習の強力なアプローチであるREINFORCEアルゴリズムを実装します。続いて、Actor-Critic手法、特にpolicy gradientと価値ベース手法の強みを組み合わせて学習効率と安定性を高めるAdvantage Actor-Critic(A2C)アルゴリズムを取り上げます。
4

Proximal Policy OptimizationとDRLの実践ヒント

堅牢なDRL性能を実現するProximal Policy Optimization(PPO)を学びます。次に、PPOにおけるエントロピーボーナスを取り上げ、方策が早期に決定論的に収束するのを防いで探索を促進する方法を確認します。さらに、policy gradient手法でのバッチ更新について学びます。最後に、Optunaを用いたハイパーパラメータ最適化を行い、DRLモデルの性能を高める方法を身につけます。

Pythonで学ぶDeep Reinforcement Learning

コース修了

達成証明書を取得する

今すぐ登録

DataCamp for Mobileでデータスキルを磨きましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進めましょう。

Pythonで学ぶDeep Reinforcement Learning | DataCamp