Zum Hauptinhalt springen

Kurs

Web Scraping in Python

Mittelstufe4 Std.

Lerne, wie du mit der Python-Bibliothek Scrapy Informationen aus dem Internet abrufst und auswertest.

Python4 Std.17 Videos56 Übungen4,500 XP94,077Leistungsnachweis

Erstelle dein kostenloses Konto

Mit Google fortfahren
oder
Wenn du fortfährst, akzeptierst du unsere Nutzungsbedingungen, unsere Datenschutzrichtlinie und dass deine Daten in den USA gespeichert werden.

Beliebt bei Lernenden in tausenden Unternehmen

Du bildest ein Team weiter?

Für Unternehmen testen

Kursbeschreibung

Die Fähigkeit, Tools zu entwickeln, die in der Lage sind, im Internet gespeicherte Informationen abzurufen und zu analysieren, war und ist in vielen Data Science-Bereichen wertvoll. In diesem Kurs lernst du, wie man HTML-Code durchsucht und analysiert und Tools zum automatischen Crawlen von Websites entwickelt. Obwohl wir unser Scraping mit der vielseitigen Python-Bibliothek Scrapy durchführen, können viele der Techniken, die du in diesem Kurs lernst, auch auf andere beliebte Python-Bibliotheken wie Beautiful Soup und Selenium angewendet werden. Nach Abschluss dieses Kurses verfügst du über ein solides Verständnis der HTML-Struktur, kannst Tools zum Parsen von HTML-Code und zum Abrufen der gewünschten Informationen erstellen und einen einfachen Scrapy-Spider zum Crawlen des Webs in großem Maßstab entwickeln.

Voraussetzungen

Lernprogramm

Kursübersicht

1

Einführung in HTML

Lerne die Struktur von HTML. Wir beginnen damit, zu erklären, warum Web Scraping eine wertvolle Ergänzung zu deiner Data Science-Toolbox sein kann, und gehen dann auf einige Grundlagen von HTML ein. Am Ende des Kapitels geben wir eine kurze Einführung in die XPath-Notation, die verwendet wird, um die Elemente im HTML Code zu navigieren.
Kapitel starten
3

CSS Locators, Chaining und Responses

Lerne die CSS Locator-Syntax und spiele mit der Idee, CSS Locators mit XPath zu verketten. Außerdem erfährst du mehr über Response-Objekte, die sich wie Selektoren verhalten, uns aber zusätzliche Tools an die Hand geben, mit denen wir unsere Scraping-Bemühungen über mehrere Websites hinweg mobilisieren können.
Kapitel starten
4

Spider

Lerne, Webcrawler mit Scrapy zu erstellen. Diese Scrapy-Spider durchforsten das Web über mehrere Seiten hinweg und folgen den Links, um jede dieser Seiten automatisch nach den Verfahren zu scrapen, die wir in den vorherigen Kapiteln gelernt haben.
Kapitel starten

Web Scraping in Python

Kurs
abgeschlossen

Leistungsnachweis verdienen

Jetzt einschreiben

Erweitere deine Datenkompetenzen mit DataCamp for Mobile

Mach Fortschritte unterwegs – mit unseren mobilen Kursen und den täglichen 5-minütigen Coding-Challenges.