Weiter zum Inhalt

Kurs

Web Scraping in Python

Mittelstufe4 Std.

Lerne, wie du mit der Python-Bibliothek Scrapy Informationen aus dem Internet abrufst und auswertest.

Python4 Std.17 Videos56 Übungen4,500 XP93,505Leistungsnachweis

Erstelle dein kostenloses Konto

Mit Google fortfahren
oder
Indem du fortfährst, akzeptierst du unsere Nutzungsbedingungen, unser Datenschutzrichtlinie und dass Ihre Daten in den USA gespeichert werden.

Geliebt von Lernenden in Tausenden Unternehmen

Kursbeschreibung

Die Fähigkeit, Tools zu entwickeln, die in der Lage sind, im Internet gespeicherte Informationen abzurufen und zu analysieren, war und ist in vielen Data Science-Bereichen wertvoll. In diesem Kurs lernst du, wie man HTML-Code durchsucht und analysiert und Tools zum automatischen Crawlen von Websites entwickelt. Obwohl wir unser Scraping mit der vielseitigen Python-Bibliothek Scrapy durchführen, können viele der Techniken, die du in diesem Kurs lernst, auch auf andere beliebte Python-Bibliotheken wie Beautiful Soup und Selenium angewendet werden. Nach Abschluss dieses Kurses verfügst du über ein solides Verständnis der HTML-Struktur, kannst Tools zum Parsen von HTML-Code und zum Abrufen der gewünschten Informationen erstellen und einen einfachen Scrapy-Spider zum Crawlen des Webs in großem Maßstab entwickeln.

Voraussetzungen

Lernprogramm

Kursübersicht

1

Einführung in HTML

Lerne die Struktur von HTML. Wir beginnen damit, zu erklären, warum Web Scraping eine wertvolle Ergänzung zu deiner Data Science-Toolbox sein kann, und gehen dann auf einige Grundlagen von HTML ein. Am Ende des Kapitels geben wir eine kurze Einführung in die XPath-Notation, die verwendet wird, um die Elemente im HTML Code zu navigieren.
Kapitel starten
3

CSS Locators, Chaining und Responses

Lerne die CSS Locator-Syntax und spiele mit der Idee, CSS Locators mit XPath zu verketten. Außerdem erfährst du mehr über Response-Objekte, die sich wie Selektoren verhalten, uns aber zusätzliche Tools an die Hand geben, mit denen wir unsere Scraping-Bemühungen über mehrere Websites hinweg mobilisieren können.
Kapitel starten
4

Spider

Lerne, Webcrawler mit Scrapy zu erstellen. Diese Scrapy-Spider durchforsten das Web über mehrere Seiten hinweg und folgen den Links, um jede dieser Seiten automatisch nach den Verfahren zu scrapen, die wir in den vorherigen Kapiteln gelernt haben.
Kapitel starten

Web Scraping in Python

Kurs
abgeschlossen

Bescheinigung über den Abschluss erhalten

Jetzt einschreiben

Datenkompetenz für unterwegs – mit der DataCamp-App

Mit unseren Kursen für Mobilgeräte und täglichen Programmier-Challenges erweiterst du deine Datenkompetenz von unterwegs.