メインコンテンツにスキップ

コース

PyTorch による効率的な AI モデルトレーニング

上級4 時間

AcceleratorとTrainerを使って分散学習で大規模言語モデルの学習時間を短縮する方法を学ぶ

Python4 時間動画 13 本演習 45 件3,850 XP1,642修了証明書

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?

法人向けプランを試す

コースの説明

分散トレーニングは、大規模な機械学習において不可欠なスキルであり、数兆のパラメータを持つ大規模言語モデルの学習に必要な時間を短縮するのに役立ちます。 このコースでは、PyTorch、Accelerator、Trainerを使った効率的な分散トレーニングに不可欠なツール、手法、戦略を学びます。

分散トレーニングのためのデータ準備

まず、データセットを複数のデバイスに分割し、各デバイスにモデルのコピーを配置して、分散トレーニングのためのデータを準備することから始めます。 分散環境向けのデータ前処理を、画像、音声、テキストを含めて実践的に学べます。

効率化手法の探求

データの準備が整ったら、複数のインターフェースにわたって、トレーニングとオプティマイザーの使用効率を向上させる方法を学びます。 メモリ使用量、デバイス間通信、計算効率を改善することで、勾配蓄積、勾配チェックポイント、ローカル確率的勾配降下法、混合精度学習といった手法を使って、これらの課題にどう対処するかを学びます。 さまざまな最適化手法のトレードオフを理解し、モデルのメモリ使用量を削減できるようになります。このコースの終了時には、分散型のAI搭載サービスを構築するための知識とツールを身につけているでしょう。

前提条件

カリキュラム

コース概要

1

Accelerator を使ったデータ準備

複数のデバイスにデータを分割し、各デバイスにモデルをコピーすることで、分散トレーニングに向けたデータ準備を行います。Accelerator はデータ準備のための便利なインターフェースを提供しており、分散トレーニングの第一歩として、画像・音声・テキストの前処理方法を学びます。
2

Accelerator と Trainer を使った分散トレーニング

3

トレーニング効率の改善

大規模なモデルやデータセットを扱う分散トレーニングは、リソースに大きな負荷をかけます。メモリ使用量、デバイス間通信、計算効率を改善することで、こうした課題に対処できます。勾配累積、勾配チェックポインティング、局所的確率的勾配降下法、混合精度トレーニングといった技術を学びましょう。

PyTorch による効率的な AI モデルトレーニング

コース修了

修了証明書を取得

今すぐ登録する

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。