Weiter zum Inhalt

Kurs

Maschinelles Lernen mit baumbasierten Modellen in Python

Mittelstufe5 Std.

In diesem Kurs lernst du, wie du baumbasierte Modelle und Ensembles für Regression und Klassifizierung mit Scikit-Learn verwendest.

Python5 Std.15 Videos57 Übungen4,650 XP110K+Leistungsnachweis

Erstelle dein kostenloses Konto

Mit Google fortfahren
oder
Indem du fortfährst, akzeptierst du unsere Nutzungsbedingungen, unser Datenschutzrichtlinie und dass Ihre Daten in den USA gespeichert werden.

Geliebt von Lernenden in Tausenden Unternehmen

Kursbeschreibung

Entscheidungsbäume sind überwachtes Lernverfahren für Klassifikations- und Regressionsaufgaben. Baum-Modelle sind sehr flexibel – das hat jedoch seinen Preis: Einerseits können Bäume komplexe, nichtlineare Zusammenhänge erfassen; andererseits neigen sie dazu, das Rauschen in einem Datensatz auswendig zu lernen. Durch das Aggregieren der Vorhersagen unterschiedlich trainierter Bäume nutzen Ensemblemethoden die Flexibilität von Bäumen und verringern gleichzeitig ihre Tendenz, Rauschen zu memorieren. Ensemblemethoden werden in vielen Bereichen eingesetzt und haben nachweislich zahlreiche Wettbewerbe im maschinellen Lernen gewonnen. In diesem Kurs lernst du, wie du mit Python Entscheidungsbäume und baumbasierte Modelle mit der benutzerfreundlichen Machine-Learning-Bibliothek scikit-learn trainierst. Du verstehst die Stärken und Schwächen von Bäumen und siehst, wie Ensembling diese Schwächen abmildern kann – anhand praxisnaher Datensätze. Abschließend lernst du, die wichtigsten Hyperparameter zu optimieren, um das Maximum aus deinen Modellen herauszuholen.

Voraussetzungen

Lernprogramm

Kursübersicht

2

Der Bias-Variance-Trade-off

Der Bias-Variance-Trade-off gehört zu den grundlegenden Konzepten des überwachten maschinellen Lernens. In diesem Kapitel lernst du, Überanpassung (Overfitting) und Unteranpassung (Underfitting) zu diagnostizieren. Außerdem bekommst du eine Einführung in Ensembling, bei dem die Vorhersagen mehrerer Modelle aggregiert werden, um robustere Vorhersagen zu erhalten.
Kapitel starten
3

Bagging und Random Forests

Bagging ist eine Ensemblemethode, bei der derselbe Algorithmus mehrfach auf unterschiedlichen, aus den Trainingsdaten gezogenen Stichproben trainiert wird. In diesem Kapitel verstehst du, wie sich mit Bagging ein Baum-Ensemble aufbauen lässt. Außerdem lernst du, wie der Random-Forests-Algorithmus durch zusätzliche Randomisierung bei jedem Split in den Bäumen des Ensembles zu noch mehr Vielfalt führt.
Kapitel starten
4

Boosting

5

Modell-Tuning

Die Hyperparameter eines Machine-Learning-Modells werden nicht aus Daten gelernt. Sie werden festgelegt, bevor das Modell auf den Trainingssatz angepasst wird. In diesem Kapitel lernst du, die Hyperparameter eines baumbasierten Modells mithilfe von Grid-Search-Cross-Validation zu optimieren.
Kapitel starten

Maschinelles Lernen mit baumbasierten Modellen in Python

Kurs
abgeschlossen

Bescheinigung über den Abschluss erhalten

Jetzt einschreiben

Datenkompetenz für unterwegs – mit der DataCamp-App

Mit unseren Kursen für Mobilgeräte und täglichen Programmier-Challenges erweiterst du deine Datenkompetenz von unterwegs.