본문으로 바로가기

코스

R로 배우는 웹 스크레이핑

중급4시간

R로 어떤 웹사이트에서도 데이터를 효율적으로 수집하고 다운로드하는 방법을 학습하세요.

R4시간13개 동영상45개 연습 문제3,600 XP15,087수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

통계, 상품 리뷰, 가격처럼 데이터가 많은 정보를 보여 주지만, 바로 분석하기엔 적합하지 않은 형식의 웹사이트를 본 적이 있으신가요? 많은 기관과 데이터 제공자가 데이터를 깔끔한 표 형태로 공개하지만, 모든 사이트에 다운로드 버튼이 있는 것은 아닙니다. 걱정 마세요. 이 강의에서는 R을 사용해 어떤 웹사이트에서도 데이터를 효율적으로 수집하고 다운로드하는 방법을 배웁니다. rvest와 httr 패키지를 사용해 Wikipedia를 자동으로 스크레이핑하고 파싱하는 법을 익히게 됩니다. 또한 실습을 통해 웹페이지의 구성 요소인 HTML과 CSS에 대한 이해를 넓히고, 데이터 수집 워크플로를 더 안전하고 효율적으로 만드는 방법을 연습합니다.

사전 요구 사항

커리큘럼

코스 개요

1

HTML과 웹 스크레이핑 입문

이 챕터에서는 현대 웹사이트의 구조를 정의하는 선언형 언어인 Hyper Text Markup Language(HTML)를 소개합니다. rvest 라이브러리를 사용해 간단한 HTML 요소를 질의하고, 첫 번째 표를 스크레이핑하는 방법을 배웁니다.
챕터 시작하기
4

스크레이핑 모범 사례

R

R로 배우는 웹 스크레이핑

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.

R로 배우는 웹 스크레이핑 | DataCamp