Build your ultimate AI agent
Kursbeskrivning
Förmågan att bygga verktyg som kan hämta och tolka information från internet har länge varit – och fortsätter att vara – värdefull inom många grenar av datavetenskap. I den här kursen lär du dig att navigera och analysera HTML-kod samt bygga verktyg för att automatiskt genomsöka webbplatser. Skrapningen genomförs med det mångsidiga Python-biblioteket scrapy, men många av de tekniker du lär dig går även att tillämpa på andra populära Python-bibliotek, till exempel BeautifulSoup och Selenium. När du har slutfört kursen har du en solid förståelse för HTML-struktur, kan bygga verktyg för att tolka HTML-kod och komma åt önskad information, samt skapa enkla scrapy-spindlar för storskalig webbgenomgång.
Förkunskapskrav
Kursplan
Kursöversikt
1
Introduktion till HTML
Lär dig HTML-strukturens uppbyggnad. Vi börjar med att förklara varför webbskrapning kan vara ett värdefullt tillskott i din datavetenskap och går sedan igenom grunderna i HTML. Kapitlet avslutas med en kort introduktion till XPath-notation, som används för att navigera bland element i HTML-kod.
2
XPath och selektorer
Använd XPath-syntax för att utforska scrapy-selektorer. Båda dessa begrepp tar dig ett steg närmare att kunna skrapa ett HTML-dokument.
3
CSS-lokaliserare, kedjebyggnad och svar
Lär dig CSS-lokaliserarsyntax och börja experimentera med att kedja ihop CSS-lokaliserare med XPath. Vi introducerar även Response-objekt, som fungerar som selektorer men erbjuder extra verktyg för att sprida dina skrapningsinsatser över flera webbplatser.
4
Spindlar
Lär dig att skapa webbsökare med scrapy. Dessa scrapy-spindlar genomsöker webben över flera sidor, följer länkar och skrapar varje sida automatiskt enligt de metoder du lärt dig i tidigare kapitel.
Webbskrapning i Python
Kurs
slutförd

