본문으로 바로가기

코스

PyTorch로 AI 모델 효율적으로 학습시키기

고급4시간

Accelerator와 Trainer로 분산 학습하여 대규모 언어 모델의 학습 시간을 줄이는 방법을 배우세요

Python4시간13개 동영상45개 연습 문제3,850 XP1,600수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

분산 학습은 대규모 머신 러닝에서 필수적인 기술로, 수조 개의 매개변수를 가진 대규모 언어 모델을 학습하는 데 필요한 시간을 줄이는 데 도움이 됩니다. 이 강의에서는 PyTorch, Accelerator, Trainer를 활용한 효율적인 분산 학습에 필수적인 도구, 기법, 전략을 살펴보게 됩니다.

분산 학습을 위한 데이터 준비

분산 학습을 위해 데이터 세트를 여러 장치에 분할하고 각 장치에 모델 복사본을 배포하는 것으로 시작합니다. 분산 환경에서 이미지, 오디오, 텍스트를 포함한 데이터 전처리 실무 경험을 쌓게 됩니다.

효율성 기법 탐구

데이터가 준비되면 여러 인터페이스에서 학습과 옵티마이저 사용의 효율성을 높이는 방법을 살펴보게 됩니다. 메모리 사용량, 디바이스 간 통신, 계산 효율성을 개선하는 기법인 gradient accumulation, gradient checkpointing, local stochastic gradient descent, mixed precision training을 통해 이러한 과제를 해결하는 방법을 배우게 됩니다. 다양한 옵티마이저 간의 트레이드오프를 이해하여 모델의 메모리 사용량을 줄이는 데 도움이 됩니다.이 강의를 마치면 분산형 AI 기반 서비스를 구축하는 데 필요한 지식과 도구를 갖추게 됩니다.

사전 요구 사항

커리큘럼

코스 개요

1

Accelerator를 활용한 데이터 준비

여러 디바이스에 데이터를 분할하고 각 디바이스에 모델을 복사하여 분산 학습을 위한 데이터를 준비합니다. Accelerator는 데이터 준비를 위한 편리한 인터페이스를 제공하며, 분산 학습의 첫 단계로 이미지, 오디오, 텍스트를 전처리하는 방법을 배웁니다.
챕터 시작하기
2

Accelerator와 Trainer를 활용한 분산 학습

3

학습 효율 향상

4

효율적인 옵티마이저를 활용한 학습

PyTorch로 AI 모델 효율적으로 학습시키기

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.