Ir al contenido principal

Curso

Machine learning con modelos basados en árboles en Python

Intermedio5 h

En este curso, aprenderás a utilizar modelos basados en árboles y conjuntos para regresión y clasificación utilizando scikit-learn.

Python5 h15 vídeos57 ejercicios4,650 XP110K+Certificado de logro

Crea tu cuenta gratis

Continuar con Google
o
Al continuar, aceptas nuestros los Términos de uso, nuestro la Política de privacidad y que tus datos se almacenan en EE. UU.

Les encanta a estudiantes de miles de empresas

¿Formando a un equipo?

Prueba para empresas

Descripción del curso

Los árboles de decisión son modelos de aprendizaje supervisado que se utilizan para problemas de clasificación y regresión. Los modelos de árbol presentan una gran flexibilidad que tiene un precio: por un lado, los árboles son capaces de captar relaciones no lineales complejas; por otro, son propensos a memorizar el ruido presente en un conjunto de datos. Al agregar las predicciones de árboles entrenados de forma diferente, los métodos de conjunto aprovechan la flexibilidad de los árboles, al tiempo que reducen su tendencia a memorizar el ruido. Los métodos de ensamblaje se utilizan en diversos campos y tienen un historial probado de victorias en muchas competiciones de machine learning. En este curso, aprenderás a utilizar Python para entrenar árboles de decisión y modelos basados en árboles con la sencilla biblioteca de machine learning scikit-learn. Comprenderás las ventajas e inconvenientes de los árboles y demostrarás cómo el ensamblaje puede paliar estos inconvenientes, todo ello mientras practicas con conjuntos de datos del mundo real. Por último, también comprenderás cómo afinar los hiperparámetros más influyentes para sacar el máximo partido a tus modelos.

Requisitos previos

Programa de formación

Contenido del curso

2

El equilibrio entre sesgo y varianza

El equilibrio entre sesgo y varianza es uno de los conceptos fundamentales del machine learning supervisado. En este capítulo, comprenderás cómo diagnosticar los problemas de sobreajuste e infraajuste. También conocerás el concepto de ensamblaje, que consiste en agregar las predicciones de varios modelos para obtener predicciones más sólidas.
Empezar capítulo
3

Bagging y bosques aleatorios

El bagging es un método de ensamblaje que consiste en entrenar el mismo algoritmo muchas veces utilizando diferentes subconjuntos muestreados de los datos de entrenamiento. En este capítulo, comprenderás cómo puede utilizarse el bagging para crear un conjunto de árboles. También aprenderás cómo el algoritmo de los bosques aleatorios puede conducir a una mayor diversidad del conjunto mediante la aleatorización a nivel de cada división en los árboles que forman el conjunto.
Empezar capítulo
4

Potenciación

El refuerzo se refiere a un método conjunto en el que se entrenan varios modelos secuencialmente y cada modelo aprende de los errores de sus predecesores. En este capítulo, conocerás los dos métodos de refuerzo: AdaBoost y Gradient Boosting (potenciación del gradiente).
Empezar capítulo
5

Ajuste del modelo

Los hiperparámetros de un modelo de machine learning son parámetros que no se aprenden a partir de los datos. Deben fijarse antes de ajustar el modelo al conjunto de entrenamiento. En este capítulo, aprenderás a ajustar los hiperparámetros de un modelo basado en árboles utilizando la validación cruzada de búsqueda en cuadrícula.
Empezar capítulo

Machine learning con modelos basados en árboles en Python

Curso
completado

Obtén el certificado de logro

Inscríbete ahora

Desarrolla tus habilidades con la aplicación móvil de DataCamp

Progresa sobre la marcha con nuestros cursos móviles y desafíos diarios de 5 minutos.