본문으로 바로가기

코스

R로 배우는 트리 기반 Machine Learning

기초4시간

tidymodels로 트리 기반 모델과 앙상블을 활용해 분류·회귀 예측 방법을 학습합니다.

R4시간16개 동영상58개 연습 문제4,850 XP10,721수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

트리 기반 Machine Learning 모델은 데이터의 복잡한 비선형 관계를 드러내며, Machine Learning 대회에서 자주 두각을 나타내요. 이 강의에서는 tidymodels 패키지를 사용해 단순한 의사결정나무부터 복잡한 랜덤 포레스트까지 다양한 트리 기반 모델을 탐색하고 구축해 봅니다. 또한 앙상블 학습을 활용해 예측 성능을 높이는 강력한 기법인 부스팅 트리도 배웁니다. 과정 전반에 걸쳐 당뇨병 발생과 고객 이탈을 예측하기 위해 건강 및 신용 위험 데이터를 다뤄 볼 거예요.

사전 요구 사항

커리큘럼

코스 개요

1

분류 나무

진짜 Machine Learning 파이프라인을 만들어 볼 준비가 되셨나요? 단계별 연습을 통해 의사결정나무를 만들고, 데이터를 분할하며, 당뇨병에 걸릴 가능성이 높은 환자를 예측하는 방법을 배워요. 마지막으로, 모델을 평가하고 예측을 판단하기 위한 성능 지표도 구축합니다.
챕터 시작하기
2

회귀 나무와 교차 검증

달콤한 예제가 준비됐어요! 초콜릿 평점 데이터셋으로 회귀 나무를 만들고, 적절한 오류 지표를 사용해 성능을 평가해 보세요. 교차 검증 같은 달콤한 기법을 적용해 단일 학습/테스트 분할의 통계적 불확실성을 극복하고, 편향-분산 균형도 더 깊이 다뤄 봅니다.
챕터 시작하기
3

하이퍼파라미터와 앙상블 모델

4

부스팅 트리

트리 기반 모델의 정수로 가 볼까요? 그래디언트 부스팅을 적용해 지금까지 보거나 만들어 본 것보다 더 뛰어난 성능을 내는 강력한 앙상블을 구축합니다. 미세 조정 방법을 익히고, 다양한 모델을 비교해 운영 환경에 배포할 최종 우승 모델을 고르는 방법을 배워요.
챕터 시작하기
R

R로 배우는 트리 기반 Machine Learning

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.