본문으로 바로가기

코스

Python으로 하는 웹 스크레이핑

중급4시간

Python 라이브러리 Scrapy를 사용하여 인터넷에서 정보를 수집하고 파싱하는 방법을 배우세요.

Python4시간17개 동영상56개 연습 문제4,500 XP93,505수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

인터넷 전반에 저장된 정보를 가져오고 파싱하는 도구를 만드는 능력은 데이터 사이언스의 여러 분야에서 과거에도, 지금도 매우 가치가 있습니다. 이 과정에서는 HTML 코드를 탐색하고 파싱하는 방법을 배우고, 웹사이트를 자동으로 크롤링하는 도구를 만들어 봅니다. 스크레이핑은 다재다능한 Python 라이브러리인 scrapy로 진행하지만, 이 과정에서 배우는 많은 기법은 BeautifulSoup과 Selenium을 비롯한 다른 인기 있는 Python 라이브러리에도 적용할 수 있습니다. 과정을 마치면 HTML 구조에 대한 견고한 정신 모델을 갖추게 되고, HTML 코드를 파싱해 원하는 정보를 가져오는 도구를 만들 수 있으며, 대규모 웹 크롤링을 수행하는 간단한 scrapy 스파이더도 작성할 수 있게 됩니다.

사전 요구 사항

커리큘럼

코스 개요

1

HTML 소개

HTML의 구조를 배웁니다. 먼저 웹 스크레이핑이 데이터 사이언스 도구 상자에 왜 유용한지 설명한 뒤, HTML의 기본을 살펴봅니다. 마지막에는 HTML 코드 내부 요소를 탐색하는 데 쓰이는 XPath 표기법을 간단히 소개합니다.
챕터 시작하기
3

CSS 로케이터, 체이닝, 그리고 Response

CSS 로케이터 문법을 배우고, CSS 로케이터를 XPath와 체이닝하는 아이디어를 실습해 봅니다. 또한 여러 웹사이트에 걸쳐 스크레이핑을 확장하는 데 유용한 추가 도구를 제공하면서 셀렉터처럼 동작하는 Response 객체를 소개합니다.
챕터 시작하기

Python으로 하는 웹 스크레이핑

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.