Build your ultimate AI agent
코스 설명
훌륭한 데이터 시각화는 임팩트 있는 데이터 과학의 핵심입니다. 시각화는 데이터에서 인사이트를 발견하고, 그 인사이트를 대상자에게 효과적으로 전달하도록 도와줍니다. 데이터 과학자가 되어 가는 과정에서 누구나 기본적인 산점도나 막대 그래프를 만드는 법은 배우지만, 데이터 시각화의 진정한 잠재력은 한발 물러서서 무엇을, 왜, 어떻게 시각화할지 고민할 때 발휘됩니다. 이 과정에서는 분석 결과를 신속하고 효과적으로 전달하는 매력적이고 설득력 있는 시각화를 만드는 방법을 배웁니다. 데이터 비교, 색상의 활용 요령, 불확실성 표현, 그리고 미국 전역의 대기 오염과 파머스 마켓 데이터셋을 탐구하면서 대상자에 맞는 올바른 시각화를 구성하는 법을 다룹니다. 마지막에는 공개된 파머스 마켓 데이터를 검토해 완성도 높고 임팩트 있는 시각화 보고서를 만들어 보겠습니다.
사전 요구 사항
커리큘럼
코스 개요
1
데이터 강조하기
모든 데이터를 보여주면서도 중요한 포인트를 놓치지 않게 하려면 어떻게 해야 할까요? 이 단원에서는 색상 하이라이트와 텍스트로 시청자를 데이터 속으로 자연스럽게 이끄는 방법을 다룹니다. 또한 미국 전역의 대표적 오염물질 수치를 담은 데이터셋을 소개합니다.
2
시각화에서의 색상 활용
색상은 데이터 시각화에서 값을 인코딩하는 강력한 도구입니다. 하지만 큰 힘에는 위험도 따릅니다. 이 단원에서는 데이터 유형에 맞춰 시각화에 적절한 색상 팔레트를 선택하는 방법을 살펴봅니다.
3
불확실성 보여주기
불확실성은 데이터 과학 전반에 존재하지만, 종종 포함되어야 할 시각화에서 빠지곤 합니다. 여기서는 신뢰구간이 무엇인지 검토하고, 단일 추정치와 연속 함수 모두에 대해 이를 시각화하는 방법을 배웁니다. 더불어 불확실성을 평가하는 부트스트랩 재표집 기법과 그 올바른 시각화 방법도 다룹니다.
4
데이터 과학 워크플로에서의 시각화
시각화는 종종 일반론적 모범 사례만을 따로 배우게 됩니다. 하지만 실제로는 상황에 따라 원칙을 유연하게 적용해야 합니다. 초기의 거친 탐색형 시각화부터 최종 결과물의 글꼴 크기를 다듬는 작업까지, 이 단원에서는 데이터 과학 워크플로의 각 단계에서 시각화를 최적화하는 방법을 깊이 있게 살펴봅니다.
Python으로 데이터 시각화 개선하기
코스
완료

