본문으로 건너뛰기

트랙

PySpark를 활용한 빅데이터

Apache Spark의 PySpark API를 사용하여 빅데이터를 처리하고 이를 효율적으로 활용하는 방법을 익히세요.

  • Python
  • 데이터 가져오기 및 정제
  • 25 hr
  • 10,134

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 사항에 동의하는 것으로 간주됩니다: 이용약관개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점에 동의하는 것으로 간주됩니다.

수천 개 기업의 학습자들이 사랑하는 서비스

팀을 교육하시나요?비즈니스용으로 사용해 보기

트랙 설명

PySpark를 활용한 빅데이터

Apache Spark를 익혀 데이터 역량을 한 단계 높이세요. Spark Python API인 PySpark를 사용하여 대규모 데이터세트에서 병렬 컴퓨팅을 활용하고, 고성능 머신 러닝을 준비하게 됩니다. 데이터 정제부터 피처 생성, 머신 러닝 모델 구현까지, Spark로 엔드투엔드 워크플로를 실행하게 됩니다. 이 트랙은 인기 있는 MovieLens 데이터세트와 Million Songs 데이터세트를 사용해 추천 엔진을 구축하는 것으로 마무리됩니다.

선수 과목

이 트랙에는 선수 조건이 없습니다

DataCamp for Mobile로 데이터 역량을 키우세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 이어가세요.