Sari la conținutul principal

Curs

Web Scraping în Python

Intermediar4 h

Învață să extragi și să analizezi informații de pe internet folosind biblioteca Python scrapy.

Python4 h{count, plural, one {# video} few {# videoclipuri} other {# de videoclipuri}}{count, plural, one {# exercițiu} few {# exerciții} other {# de exerciții}}4,500 XP93,505Declarație de finalizare

Creează-ți contul gratuit

Continuă cu Google
sau
Continuând, accepți Termeni de utilizare, al nostru Politica de confidențialitate și că datele tale sunt stocate în SUA.

Iubit de cursanți din mii de companii

Instruiești o echipă?

Încearcă pentru business

Descrierea cursului

Capacitatea de a construi instrumente care pot extrage și analiza informații de pe internet a fost și rămâne valoroasă în multe domenii ale științei datelor. În acest curs, vei învăța să navighezi și să parsezi cod HTML și să construiești instrumente care să parcurgă automat site-uri web. Deși scraping-ul va fi realizat cu ajutorul bibliotecii Python versatile scrapy, multe dintre tehnicile pe care le vei învăța pot fi aplicate și altor biblioteci populare Python, inclusiv BeautifulSoup și Selenium. La finalul cursului, vei avea o înțelegere solidă a structurii HTML, vei putea construi instrumente pentru a parsa cod HTML și a accesa informațiile dorite, și vei crea spidere scrapy simple pentru a parcurge web-ul la scară largă.

Cerințe prealabile

Curriculum

Structura cursului

1

Introducere în HTML

Descoperă structura HTML. Începem prin a explica de ce web scraping-ul poate fi un instrument valoros în setul tău de instrumente pentru știința datelor, apoi aprofundăm noțiunile de bază ale HTML. Capitolul se încheie cu o scurtă introducere în notația XPath, folosită pentru a naviga prin elementele unui document HTML.
Începe capitolul
3

Locatori CSS, Înlănțuire și Răspunsuri

Învață sintaxa locatorilor CSS și începe să experimentezi cu înlănțuirea locatorilor CSS cu XPath. Introducem și obiectele Response, care se comportă similar cu selectorii, dar îți oferă instrumente suplimentare pentru a-ți extinde eforturile de scraping pe mai multe site-uri web.
Începe capitolul
4

Spidere

Învață să creezi crawlere web cu scrapy. Aceste spidere scrapy vor parcurge web-ul prin mai multe pagini, urmând linkuri pentru a face scraping automat pe fiecare pagină, conform procedurilor învățate în capitolele anterioare.
Începe capitolul

Web Scraping în Python

Curs
finalizat

Obține Declarația de Realizare

Înscrie-te acum

Dezvoltă-ți competențele în date cu DataCamp pentru mobil

Progresează oricând cu cursurile noastre mobile și provocările zilnice de programare de 5 minute.