Nach diesen Kursen fühle ich mich sicher, professionelle Visualisierungen und Dashboards zu erstellen.
Kursbeschreibung
Stell dir vor, du hast eine Sammlung von Kundinnen und Kunden mit verschiedenen Merkmalen wie Alter, Standort und finanzieller Historie und möchtest Muster entdecken und sie in Cluster einteilen. Oder du hast eine Menge Texte, etwa Wikipedia-Seiten, und willst sie anhand ihres Inhalts in Kategorien segmentieren. Das ist die Welt des Unsupervised Learning – so genannt, weil du die Mustersuche nicht durch eine Vorhersageaufgabe leitest oder überwachst, sondern verborgene Strukturen in unbeschrifteten Daten aufdeckst. Unsupervised Learning umfasst eine Vielzahl von Techniken im Machine Learning – von Clustering über Dimensionsreduktion bis hin zur Matrixfaktorisierung. In diesem Kurs lernst du die Grundlagen des Unsupervised Learning und setzt die wichtigsten Algorithmen mit scikit-learn und SciPy um. Du lernst, unbeschriftete Datensätze zu clustern, zu transformieren, zu visualisieren und daraus Erkenntnisse zu gewinnen – und beendest den Kurs mit dem Bau eines Empfehlungssystems, das beliebte Musik-Künstlerinnen und -Künstler vorschlägt.Die Videos enthalten Live-Transkripte, die du unten links im Video über „Show transcript“ einblenden kannst.
Das Kursglossar findest du rechts im Bereich „Resources“.Um CPE-Credits zu erhalten, musst du den Kurs abschließen und in der qualifizierten Bewertung mindestens 70 % erreichen. Du gelangst zur Bewertung, indem du rechts auf den Hinweis zu den CPE-Credits klickst.
Voraussetzungen
Lernprogramm
Kursübersicht
1
Clustering zur Datensatz-Erkundung
Lerne, die zugrunde liegenden Gruppen (oder „Cluster“) in einem Datensatz zu entdecken. Am Ende dieses Kapitels clusterst du Unternehmen anhand ihrer Aktienkurse und unterscheidest verschiedene Arten, indem du ihre Messwerte clustert.
- Unüberwachtes Lernen50 XP
- Wie viele Cluster?50 XP
- Clustering von zweidimensionalen Punkten100 XP
- Untersuche dein Clustering100 XP
- Bewertung eines Clustering50 XP
- Wie viele Getreide-Cluster?100 XP
- Bewertung des Getreide-Clusterings100 XP
- Merkmale transformieren für bessere Clusterings50 XP
- Fischdaten fürs Clustering skalieren100 XP
- Fischdaten clustern100 XP
- Aktien mit KMeans clustern100 XP
- Welche Aktien bewegen sich gemeinsam?100 XP
2
Visualisierung mit hierarchischem Clustering und t-SNE
In diesem Kapitel lernst du zwei Unsupervised-Learning-Techniken zur Datenvisualisierung kennen: hierarchisches Clustering und t-SNE. Hierarchisches Clustering fasst Datenproben zu immer gröberen Clustern zusammen und erzeugt so eine Baumvisualisierung der resultierenden Cluster-Hierarchie. t-SNE projiziert die Datenproben in einen 2D-Raum, sodass ihre Nähe zueinander visuell dargestellt werden kann.
3
Daten decorrelieren und Dimensionsreduktion
Dimensionsreduktion fasst einen Datensatz anhand häufig auftretender Muster zusammen. In diesem Kapitel lernst du die grundlegendste Technik der Dimensionsreduktion kennen: die „Principal Component Analysis“ („PCA“). PCA wird oft vor dem Supervised Learning eingesetzt, um Modellleistung und Generalisierung zu verbessern. Es ist auch für Unsupervised Learning nützlich. Du wirst zum Beispiel eine Variante von PCA verwenden, mit der du Wikipedia-Artikel nach ihrem Inhalt clustern kannst!
4
Interpretierbare Merkmale entdecken
In diesem Kapitel lernst du eine Technik der Dimensionsreduktion kennen, die „Non-negative Matrix Factorization“ („NMF“), die Proben als Kombinationen interpretierbarer Teile darstellt. So werden etwa Dokumente als Kombinationen von Themen ausgedrückt und Bilder anhand häufig auftretender visueller Muster. Außerdem lernst du, mit NMF Empfehlungssysteme zu bauen, die dir ähnliche Artikel zum Lesen vorschlagen oder Musik-Künstlerinnen und -Künstler empfehlen, die zu deinem Hörverhalten passen!
Unsupervised Learning in Python
Kurs
abgeschlossen

