Vai al contenuto principale

Corso

Gestione dei dati mancanti con imputazioni in R

Avanzato4 h

Diagnostica, visualizza e gestisci i dati mancanti con diverse tecniche di imputazione e consigli per migliorare i tuoi risultati.

R4 h13 video49 esercizi4,200 XP6,273Attestato di completamento

Crea il tuo account gratuito

Continua con Google
oppure
Continuando, accetti la nostra Termini di utilizzo, i nostri Informativa sulla privacy e il fatto che i tuoi dati sono archiviati negli USA.

Scelto dagli studenti di migliaia di aziende

Descrizione del corso

I dati mancanti sono ovunque. Il processo di riempire i valori assenti si chiama imputazione, e saperlo fare correttamente è una competenza essenziale se vuoi ottenere previsioni accurate e distinguerti. In questo corso imparerai a usare visualizzazioni e test statistici per riconoscere gli schemi di dati mancanti e a imputare i dati utilizzando una serie di modelli statistici e di Machine Learning. Svilupperai anche capacità decisionali, utili per scegliere il metodo di imputazione più adatto in una determinata situazione. Infine, imparerai a incorporare l’incertezza derivante dall’imputazione nelle tue inferenze e previsioni, rendendole più robuste e affidabili.

Prerequisiti

Programma

Struttura del corso

1

Il problema dei dati mancanti

2

Imputazione basata su donatori

Conosci la tassonomia dei metodi di imputazione e impara tre tecniche basate su donatori: imputazione con media, hot-deck e k-Nearest-Neighbors. Guarderai sotto il cofano per vedere come funzionano questi metodi, per poi imparare ad applicarli a un insieme di dati meteorologici tropicali reali. Lungo il percorso, scoprirai anche trucchi utili per farli funzionare ancora meglio sui tuoi problemi.
Inizia il capitolo
3

Imputazione basata su modelli

È il momento di imparare a usare modelli statistici e di Machine Learning, come regressione lineare, regressione logistica e random forests, per imputare i dati mancanti. In questo capitolo analizzerai come i modelli producono le loro previsioni e userai questa conoscenza per estrarre i valori imputati da distribuzioni condizionali. Questo è importante perché garantisce imputazioni più varie e plausibili, rendendole più simili ai dati reali.
Inizia il capitolo
4

Incertezza dell’imputazione

I valori imputati non sono scolpiti nella pietra. Sono solo stime, e le stime comportano una certa incertezza. In questo capitolo finale scoprirai come il bootstrapping e le equazioni concatenate con il pacchetto mice possono essere usati per incorporare l’incertezza dell’imputazione nei tuoi modelli e nelle tue analisi, rendendoli più affidabili e robusti.
Inizia il capitolo
R

Gestione dei dati mancanti con imputazioni in R

Corso
completato

Ottieni Attestato di conseguimento

Iscriviti ora

Sviluppa le tue competenze sui dati con DataCamp for Mobile

Fai progressi ovunque tu sia con i nostri corsi mobile e le sfide di programmazione quotidiane da 5 minuti.