본문으로 바로가기

코스

R에서 sparklyr로 시작하는 Spark

중급4시간

Spark와 R의 sparklyr 패키지로 빅 데이터 분석을 실행하고, 4시간 만에 Spark MLIb를 살펴보세요.

R4시간4개 동영상50개 연습 문제4,600 XP20,261수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

R, Spark, 그리고 sparklyr의 장점을 살펴보세요

R은 주로 데이터 분석 코드를 빠르고 읽기 쉽게 작성하도록 돕는 데 최적화되어 있습니다. Apache Spark는 방대한 데이터세트를 빠르게 분석하도록 설계되었습니다. sparklyr 패키지를 사용하면 Spark 클러스터에서 실행되는 dplyr R 코드를 작성할 수 있어, 두 세계의 장점을 모두 누릴 수 있습니다. 이 4시간짜리 강의에서는 dplyr 인터페이스와 Spark의 기본 인터페이스를 모두 사용해 Spark DataFrame을 조작하는 방법과 머신 러닝 기법을 적용하는 방법을 배웁니다.

Spark에 데이터를 로드하고 Spark DataFrame을 조작하기

이 Spark 강의에서는 Spark와 R이 어떻게 잘 함께 작동하는지 살펴보고, 정리, 변환, 분석을 위한 데이터 로딩을 연습하며 시작합니다. Spark 프레임과 dplyr 구문을 사용해 필터링과 행 정렬, 그리고 열 변형과 요약을 통해 데이터를 조작하게 됩니다.

Spark MLib로 빅 데이터 분석을 깊이 있게 배워보세요

이 강의는 방대한 데이터세트를 분석하는 데 필요한 기술과 자신감을 키우는 데 중점을 둡니다. 마지막 장에서는 Spark의 머신 러닝 데이터 변환 특성을 살펴보고, gradient boosted trees와 random forests를 사용해 예측을 수행하면서 sparklyr의 머신 러닝 루틴을 실습 문제로 연습할 기회를 제공합니다. "

사전 요구 사항

커리큘럼

코스 개요

1

불 붙이기: dplyr 문법으로 Spark 시작하기

R

R에서 sparklyr로 시작하는 Spark

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.