Pular para o conteúdo principal

Curso

Aprendizado de máquina com modelos baseados em árvores em Python

Intermediário5 h

Neste curso, você aprenderá a usar modelos baseados em árvores e conjuntos para regressão e classificação usando o scikit-learn.

Python5 h15 vídeos57 exercícios4,650 XP110K+Declaração de aproveitamento

Crie sua conta gratuita

Continuar com o Google
ou
Ao continuar, você aceita nossos Termos de uso, nosso Política de privacidade e que seus dados sejam armazenados nos EUA.

Amado por alunos em milhares de empresas

Treinando um time?

Teste para empresas

Descrição do curso

As árvores de decisão são modelos de aprendizado supervisionado usados para problemas que envolvem classificação e regressão. Os modelos de árvore apresentam uma alta flexibilidade que tem um preço: por um lado, as árvores são capazes de capturar relações não lineares complexas; por outro lado, elas são propensas a memorizar o ruído presente em um conjunto de dados. Ao agregar as previsões de árvores treinadas de forma diferente, os métodos de agrupamento aproveitam a flexibilidade das árvores e reduzem sua tendência de memorizar ruídos. Os métodos de agrupamento são usados em uma variedade de campos e têm um histórico comprovado de vitórias em muitas competições de aprendizado de máquina. Neste curso, você aprenderá a usar o Python para treinar árvores de decisão e modelos baseados em árvores com a biblioteca de aprendizado de máquina scikit-learn, de fácil utilização. Você entenderá as vantagens e as deficiências das árvores e demonstrará como o agrupamento pode atenuar essas deficiências, tudo isso enquanto pratica com conjuntos de dados do mundo real. Por fim, você também entenderá como ajustar os hiperparâmetros mais influentes para obter o máximo dos seus modelos.

Pré-requisitos

Programa de estudos

Conteúdo do curso

2

O comprometimento entre viés e variância

A troca de viés e variância é um dos conceitos fundamentais do aprendizado de máquina supervisionado. Neste capítulo, você entenderá como diagnosticar os problemas de sobreajuste e subajuste. Você também conhecerá o conceito de agrupamento, em que as previsões de vários modelos são agregadas para produzir previsões mais robustas.
Começar capítulo
3

Agregação de Bootstrap e Florestas Aleatórias

Agregação de bootstrap é um método de agrupamento que envolve o treinamento do mesmo algoritmo várias vezes usando diferentes subconjuntos amostrados dos dados de treinamento. Neste capítulo, você entenderá como a agregação de bootstrap pode ser usada para criar um agrupamento de árvores. Você também aprenderá como o algoritmo de florestas aleatórias pode levar a uma maior diversidade de agrupamentos por meio da randomização no nível de cada divisão nas árvores que formam o agrupamento.
Começar capítulo
4

Boosting

Boosting refere-se a um método de agrupamento no qual vários modelos são treinados sequencialmente com cada modelo aprendendo com os erros de seus predecessores. Neste capítulo, você conhecerá os dois métodos de boosting do AdaBoost e do Gradient Boosting.
Começar capítulo
5

Ajuste de modelo

Os hiperparâmetros de um modelo de aprendizado de máquina são parâmetros que não são aprendidos com os dados. Eles devem ser definidos antes de você ajustar o modelo ao conjunto de treinamento. Neste capítulo, você aprenderá a ajustar os hiperparâmetros de um modelo baseado em árvore usando a validação cruzada de pesquisa de grade.
Começar capítulo

Aprendizado de máquina com modelos baseados em árvores em Python

Curso
concluído

Obtenha o certificado de conclusão

Inscreva-se agora

Desenvolva suas habilidades em dados com o DataCamp for Mobile

Continue progredindo em qualquer lugar com nossos cursos e desafios diários de programação de 5 minutos.