본문으로 바로가기
Spark

강의

PySpark로 추천 엔진 만들기

고급기술 수준
업데이트됨 2026. 4.
자신의 빅데이터를 활용해 사용자에게 긍정적 경험을 제공하는 도구와 기법을 학습하세요.
무료로 강의 시작
SparkMachine Learning
4시간
15 동영상
56 연습 문제
4,550 XP
14,147
성취 증명서

무료 계정 만들기

Google에서 계속 진행더 많은 옵션 보기

또는


계속 진행하시면 당사의 이용약관개인정보처리방침에 동의하고 및 귀하의 데이터가 미국에 저장되는 것에 동의하게 됩니다.

수천 개 기업의 학습자들이 사랑하는

Group

팀을 교육하시나요?

비즈니스용으로 체험해 보세요

강의 설명

이 강의에서는 PySpark의 Alternating Least Squares를 사용해 추천 엔진을 만드는 방법을 알아봅니다. 널리 쓰이는 MovieLens 데이터셋과 Million Songs 데이터셋을 활용해, Alternating Least Squares 알고리즘의 직관부터 다양한 고객 데이터에 대해 ALS 모델을 학습, 테스트, 구현하는 코드까지 단계별로 안내해 드려요.

선수 조건

Supervised Learning with scikit-learnIntroduction to PySpark
1

추천은 어디에나 있습니다

이 장에서는 추천 엔진이 얼마나 강력한지 살펴보고, 협업 필터링 엔진과 콘텐츠 기반 엔진의 중요한 차이점, 그리고 추천 엔진이 사용할 수 있는 암묵적/명시적 데이터의 유형을 소개합니다. 또한 고객 데이터셋에 존재하는지조차 몰랐던 숨은 특징(잠재 특징)을 찾아내는 매우 강력한 방법도 배우게 됩니다.
챕터 시작
2

ALS는 어떻게 동작하나요?

이 장에서는 행렬 곱셈과 행렬 분해의 기본 개념을 복습하고, Alternating Least Squares 알고리즘이 어떻게 작동하는지, 최적의 추천을 반환하기 위해 어떤 인자와 하이퍼파라미터를 사용하는지 깊이 있게 알아봅니다. 또한 Spark에서 ALS를 위해 데이터를 올바르게 준비하는 데 필요한 중요한 기법도 학습합니다.
챕터 시작
4

고객 평점이 없다면 어떻게 하나요?

대부분의 실제 상황에서는 ALS 모델을 구축하는 데 필요한 "완벽한" 고객 데이터를 갖추지 못하는 경우가 많습니다. 이 장에서는 고객 행동 데이터를 활용해 고객 평점을 "추론"하고, 그 추론된 평점을 사용해 ALS 추천 엔진을 만드는 방법을 배웁니다. Million Songs 데이터셋과 또 다른 버전의 MovieLens 데이터셋을 사용하여, 가용한 데이터를 바탕으로 ALS로 추천 엔진을 구축하고 그 성능을 평가하는 방법을 보여드립니다.
챕터 시작
PySpark로 추천 엔진 만들기
강의
완료

수료증 획득

LinkedIn 프로필, 이력서 또는 CV에 이 인증서를 추가하세요
소셜 미디어와 성과 평가에서 공유하세요
지금 등록

19백만 명 이상의 학습자와 함께 PySpark로 추천 엔진 만들기을(를) 시작하세요!

무료 계정 만들기

Google에서 계속 진행더 많은 옵션 보기

또는


계속 진행하시면 당사의 이용약관개인정보처리방침에 동의하고 및 귀하의 데이터가 미국에 저장되는 것에 동의하게 됩니다.

DataCamp for Mobile을 통해 데이터 분석 능력을 향상시키세요.

모바일 강좌와 매일 5분 코딩 챌린지를 통해 이동 중에도 학습 효과를 높이세요.