Ga naar hoofdinhoud

Cursus

Unsupervised Learning in Python

Gemiddeld4 u

Leer hoe je kunt clusteren, transformeren, visualiseren en inzichten kunt halen uit niet-gelabelde datasets met behulp van scikit-learn en scipy.

Python4 u13 video's52 oefeningen4,150 XP180K+Verklaring van prestatie

Maak je gratis account aan

Ga verder met Google
of
Door verder te gaan, accepteer je ons Gebruiksvoorwaarden, onze Privacybeleid en dat je gegevens in de VS worden opgeslagen.

Geliefd bij lerenden bij duizenden bedrijven

Train je een team?

Probeer for Business

Cursusbeschrijving

Stel, je hebt een groep klanten met allerlei kenmerken, zoals leeftijd, locatie en financiële geschiedenis, en je wilt patronen ontdekken en ze in clusters indelen. Of je hebt een verzameling teksten, zoals Wikipedia-pagina’s, en je wilt ze op basis van inhoud in categorieën verdelen. Dit is de wereld van unsupervised learning: je stuurt of “superviseert” de patroonontdekking niet met een voorspellingstaak, maar legt verborgen structuur bloot in ongelabelde data. Unsupervised learning omvat allerlei Machine Learning-technieken, van clusteren tot dimensiereductie en matrixfactorisatie. In deze cursus leer je de basis van unsupervised learning en implementeer je de belangrijkste algoritmen met scikit-learn en SciPy. Je leert hoe je ongelabelde gegevenssets kunt clusteren, transformeren, visualiseren en er inzichten uit haalt, en sluit af met het bouwen van een aanbevelingssysteem dat populaire muzikale artiesten aanbeveelt.De video’s bevatten live-transcripts die je kunt openen door linksonder in de video’s op "Show transcript" te klikken. De cursusterminologie vind je rechts in het gedeelte met bronnen.Om CPE-credits te behalen, moet je de cursus afronden en minimaal 70% scoren op de gekwalificeerde toets. Je gaat naar de toets via de CPE-creditsvermelding aan de rechterkant.

Vereisten

Lesprogramma

Cursusoverzicht

1

Clusteren om je gegevensset te verkennen

2

Visualiseren met hiërarchisch clusteren en t-SNE

In dit hoofdstuk leer je twee unsupervised learning-technieken voor datavisualisatie: hiërarchisch clusteren en t-SNE. Hiërarchisch clusteren voegt datasamples samen tot steeds grovere clusters en levert zo een boomvisualisatie van de clustergelaagdheid op. t-SNE projecteert de datasamples in 2D-ruimte zodat je hun onderlinge nabijheid kunt visualiseren.
Hoofdstuk starten
3

Je data decorreleren en dimensiereductie

Dimensiereductie vat een gegevensset samen via veelvoorkomende patronen. In dit hoofdstuk leer je de belangrijkste techniek voor dimensiereductie kennen: "Principal Component Analysis" ("PCA"). PCA wordt vaak vóór supervised learning gebruikt om de modelprestatie en generalisatie te verbeteren. Het is ook nuttig voor unsupervised learning. Je gebruikt bijvoorbeeld een variant van PCA waarmee je Wikipedia-artikelen op basis van hun inhoud kunt clusteren!
Hoofdstuk starten
4

Ontdekken van interpreteerbare kenmerken

In dit hoofdstuk maak je kennis met een techniek voor dimensiereductie, "Non-negative matrix factorization" ("NMF"), die samples uitdrukt als combinaties van interpreteerbare onderdelen. Zo kun je documenten weergeven als combinaties van onderwerpen en afbeeldingen als veelvoorkomende visuele patronen. Je leert ook NMF gebruiken om aanbevelingssystemen te bouwen die vergelijkbare artikelen kunnen vinden om te lezen, of muzikale artiesten die passen bij je luistergeschiedenis!
Hoofdstuk starten

Unsupervised Learning in Python

Cursus
voltooid

Verdien een prestatieverklaring

Schrijf je nu in

Ontwikkel je datavaardigheden met DataCamp for Mobile

Boek onderweg vooruitgang met onze mobiele cursussen en dagelijkse coding-uitdagingen van 5 minuten.