Weiter zum Inhalt

Kurs

Cluster Analysis in Python

Mittelstufe4 Std.

In diesem Kurs über unüberwachtes Lernen wendest du Techniken wie hierarchisches und k-Means-Clustering mit der SciPy-Bibliothek an.

Python4 Std.14 Videos46 Übungen3,650 XP65,448Leistungsnachweis

Erstelle dein kostenloses Konto

Mit Google fortfahren
oder
Indem du fortfährst, akzeptierst du unsere Nutzungsbedingungen, unser Datenschutzrichtlinie und dass Ihre Daten in den USA gespeichert werden.

Geliebt von Lernenden in Tausenden Unternehmen

Kursbeschreibung

Du kennst bestimmt Google News, wo ähnliche Artikel automatisch unter einem Thema gruppiert werden. Hast du dich schon mal gefragt, welcher Prozess im Hintergrund diese Gruppen bildet? In diesem Kurs lernst du unüberwachtes Lernen mithilfe von Clustering mit der SciPy-Bibliothek in Python kennen. Der Kurs behandelt die Vorverarbeitung von Daten sowie die Anwendung von hierarchischem Clustering und K-Means-Clustering. Außerdem arbeitest du mit Spielerstatistiken aus dem beliebten Fußball-Videospiel FIFA 18. Nach Abschluss des Kurses kannst du verschiedene Clustering-Algorithmen schnell auf Daten anwenden, die entstehenden Cluster visualisieren und die Ergebnisse analysieren.

Voraussetzungen

Lernprogramm

Kursübersicht

1

Einführung in Clustering

Bevor du bereit bist, Nachrichtenartikel zu klassifizieren, brauchst du die Grundlagen des Clustering. Dieses Kapitel macht dich mit einer Klasse von Machine-Learning-Algorithmen vertraut, dem unüberwachten Lernen, und führt dich dann in Clustering ein, einen der beliebtesten Algorithmen des unüberwachten Lernens. Du lernst zwei gängige Clustering-Verfahren kennen – hierarchisches Clustering und K-Means-Clustering. Das Kapitel schließt mit grundlegenden Schritten der Vorverarbeitung, bevor du mit dem Clustern von Daten beginnst.
Kapitel starten
2

Hierarchisches Clustering

Dieses Kapitel konzentriert sich auf einen beliebten Clustering-Algorithmus – das hierarchische Clustering – und seine Implementierung in SciPy. Neben dem Ablauf zur Durchführung des hierarchischen Clustering hilft es dir, eine wichtige Frage zu beantworten: Wie viele Cluster sind in deinen Daten vorhanden? Das Kapitel endet mit einer Diskussion über die Grenzen des hierarchischen Clustering und mit Überlegungen zur praktischen Anwendung.
Kapitel starten
3

K-Means-Clustering

Dieses Kapitel führt einen anderen Clustering-Algorithmus ein – das K-Means-Clustering – und dessen Implementierung in SciPy. K-Means-Clustering überwindet den größten Nachteil des hierarchischen Clustering, der im letzten Kapitel besprochen wurde. Da Dendrogramme spezifisch für hierarchisches Clustering sind, wird in diesem Kapitel eine Methode behandelt, um die Anzahl der Cluster zu bestimmen, bevor du K-Means-Clustering ausführst. Das Kapitel schließt mit einer Diskussion über die Grenzen des K-Means-Clustering und mit Hinweisen zur Anwendung dieses Verfahrens.
Kapitel starten
4

Clustering in der Praxis

Nachdem du nun zwei der beliebtesten Clustering-Techniken kennst, hilft dir dieses Kapitel, dieses Wissen auf reale Problemstellungen anzuwenden. Zuerst geht es um das Bestimmen dominanter Farben in einem Bild, bevor wir zum in der Einführung erwähnten Problem übergehen – dem Clustern von Nachrichtenartikeln. Abschließend folgt eine Diskussion über Clustering mit mehreren Variablen, was die Visualisierung aller Daten erschwert.
Kapitel starten

Cluster Analysis in Python

Kurs
abgeschlossen

Bescheinigung über den Abschluss erhalten

Jetzt einschreiben

Datenkompetenz für unterwegs – mit der DataCamp-App

Mit unseren Kursen für Mobilgeräte und täglichen Programmier-Challenges erweiterst du deine Datenkompetenz von unterwegs.