본문으로 바로가기

코스

Hugging Face로 배우는 멀티모달 모델

중급4시간

Hugging Face의 최신 AI 모델로 텍스트, 이미지, 오디오, 비디오를 결합하고 새로운 이미지와 비디오를 생성하세요!

Python4시간14개 동영상45개 연습 문제3,800 XP1,937수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

멀티모달 AI의 힘을 활용하세요

텍스트, 이미지, 음성이 결합되어 강력한 애플리케이션을 만들어내는 최첨단 멀티모달 AI 모델의 세계로 들어가 보세요. Hugging Face의 방대한 모델 저장소를 활용해, 그 어느 때보다도 보고, 듣고, 이해할 수 있는 모델을 사용하는 방법을 배워보세요. 소셜 미디어 콘텐츠를 분석하든, 음성 비서를 구축하든, 차세대 AI 애플리케이션을 만들든, 멀티모달 모델은 다양한 데이터 유형을 매끄럽게 다루는 데 필요한 관문입니다.

필수 멀티모달 기법 마스터하기

이미지-텍스트 이해를 위한 CLIP, 음성 합성을 위한 SpeechT5, 그리고 멀티모달 감성 분석을 위한 Qwen2 Vision Language 모델과 같은 최첨단 모델을 살펴보세요. 실습 중심의 연습을 통해, 선도적인 AI 기업들이 정교한 멀티모달 시스템을 구축할 때 사용하는 기법을 익히게 됩니다.

AI 역량을 미래에 대비하세요

이 강의는 멀티모달 AI 작업을 처리할 수 있는 탄탄한 도구 세트를 제공합니다. 여러 데이터 모달리티를 효과적으로 처리하고 결합하는 방법, 맞춤형 애플리케이션을 위해 사전 학습된 모델을 미세 조정하는 방법, 그리고 다양한 모달리티 전반에서 모델 성능을 평가하고 개선하는 방법을 배우게 됩니다.

사전 요구 사항

커리큘럼

코스 개요

1

Hugging Face 모델과 데이터셋 액세스

Hugging Face Model Hub를 탐색하고, 원시 텍스트·오디오·시각 데이터를 AI 친화적 형식으로 변환해 보세요. 텍스트 생성 등 다양한 작업에 최신 인기 모델을 찾는 법과, 미리 만들어진 파이프라인의 강력을 활용하는 방법을 배웁니다.
챕터 시작하기
2

단일 모달 비전, 오디오, 텍스트 모델

최신 state-of-the-art 모델로 각 모달리티를 확실히 익혀 보세요. 이미지 분류와 세그멘테이션을 위한 컴퓨터 비전을 깊이 있게 다루고, 음성 인식과 텍스트-투-스피치 합성을 탐구하며, 효과적인 파인튜닝 기법을 학습합니다. Hugging Face의 transformers 라이브러리에서 제공하는 사전 학습 모델로 실전 스킬을 쌓습니다.
챕터 시작하기
3

멀티모달 분류 모델

시각, 텍스트, 오디오 정보를 융합해 더 풍부한 AI 애플리케이션을 만들어 보세요. CLIP을 활용한 zero-shot 분류 같은 기법을 익히고, 보고 읽는 감성 분석기와 표정과 목소리를 결합한 감정 탐지기를 구축합니다. 단일 모달의 한계를 넘어서는 AI 모델을 만들어 보세요.
챕터 시작하기
4

멀티모달 생성

아이디어를 현실로! 텍스트 프롬프트로 시각 콘텐츠를 생성하고 조작하는 최첨단 AI 기법을 익힙니다. 인상적인 이미지를 만들고, 사진을 지능적으로 편집하며, 이미지와 문서를 위한 강력한 질의응답 시스템을 구축하세요. 멀티모달 AI로 창의적인 비전을 디지털 현실로 바꿔 보세요.
챕터 시작하기

Hugging Face로 배우는 멀티모달 모델

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.