Build your ultimate AI agent
코스 설명
대규모 데이터셋을 효율적으로 다루고 가치 있는 정보를 추출하는 능력은 모든 예비 데이터 과학자에게 필수적인 도구입니다. 적은 양의 데이터로 작업할 때는 코드 실행이 얼마나 느릴 수 있는지 종종 체감하지 못합니다. 이 과정에서는 Python과 pandas 라이브러리에 대한 지식을 바탕으로, 작업을 더 빠르게 수행할 수 있는 pandas의 효율적인 내장 함수를 소개합니다. pandas의 내장 함수는 데이터에서 특정 항목과 열을 선택하는 가장 기본적인 작업부터, 그룹별로 함수를 적용하는 가장 복잡한 작업까지, 일반적인 Python 방식보다 훨씬 빠르게 처리할 수 있게 해줍니다. 과정을 마치면 특정 특성값에 따라 함수 적용하기, 대규모 데이터셋을 빠르게 반복 처리하기, 서로 다른 그룹에 속한 데이터를 효율적으로 조작하기가 가능해집니다. 포커 핸드나 레스토랑 팁처럼 다양한 실제 데이터셋에 이러한 방법을 직접 적용해 보게 됩니다.
사전 요구 사항
커리큘럼
코스 개요
1
열과 행을 효율적으로 선택하기
이 장에서는 왜 효율적인 코드가 중요한지, 그리고 특정/무작위 행과 열을 효율적으로 선택하는 방법을 살펴봅니다.
2
DataFrame에서 값 바꾸기
이 장에서는 리스트와 딕셔너리를 사용해 하나 이상의 값을 바꾸는 replace() 함수의 활용법을 다룹니다.
3
효율적인 반복 처리
이 장에서는 Pandas DataFrame을 반복 처리하는 여러 방법을 소개하고, 벡터화가 가장 효율적인 방법인 이유를 설명합니다.
4
.groupby()를 사용한 데이터 조작
이 장에서는 groupby() 함수와 이를 사용해 값을 제자리에서 변환하고, 결측치를 대체하며, 그룹별로 복잡한 함수를 적용하는 방법을 설명합니다.
pandas로 효율적인 코드 작성하기
코스
완료

