Build your ultimate AI agent
코스 설명
여러 변수를 포함하는 데이터를 다룰 때, 우리는 다변량 통계를 사용해 변수 간의 관계를 분석하는 데 관심을 갖습니다. 이 강의에서는 이러한 데이터셋을 분석하는 다양한 방법을 배웁니다. 다변량 정규분포, 다변량 t분포, 그리고 여러 다변량 왜도 분포를 포함한 주요 다변량 확률 분포를 학습합니다. 이후 주성분 분석(PCA)과 다차원 척도법(MDS)을 활용해 고차원 데이터를 더 적은 차원으로 표현하는 기법도 소개합니다.
사전 요구 사항
커리큘럼
코스 개요
1
다변량 데이터 읽기 및 시각화
다변량 데이터 입문 챕터에서는 데이터를 읽고 요약하는 방법을 배웁니다. 평균 벡터, 분산-공분산 행렬, 상관 행렬과 같은 기술 통계량을 사용해 다변량 데이터를 요약하는 방법을 학습합니다. 이후 다변량 데이터에 대한 통찰을 제공하는 시각화 기법도 살펴봅니다.
2
다변량 정규분포
이 챕터에서는 가장 중요하고 널리 사용되는 다변량 확률 분포인 다변량 정규분포를 소개합니다. 다변량 정규분포에서 난수 표본을 생성하고, 이 분포의 밀도와 확률을 계산 및 시각화하는 방법을 배웁니다. 또한 데이터셋이 다변량 정규성을 따르는지 검정하는 방법도 학습합니다.
3
기타 다변량 분포
이 챕터에서는 비정규 데이터를 모델링하기 위한 다양한 확률 분포를 소개합니다. 특히 두꺼운 꼬리를 모델링할 수 있으며 단변량 Student t분포를 일반화한 다변량 t분포를 학습합니다. 또한 오른쪽 또는 왼쪽으로 치우친 데이터를 모델링하도록 설계된 다양한 왜도 분포도 소개합니다.
4
주성분 분석과 다차원 척도법
마지막 챕터에서는 주성분 분석(PCA)과 다차원 척도법(MDS)을 포함한 고차원 데이터 분석 기법을 소개합니다. 실제 데이터를 분석하며 이 기법들을 직접 구현하는 방법도 학습합니다.
R
R로 배우는 다변량 확률 분포
코스
완료

