Vai al contenuto principale

Corso

Gestione dei dati mancanti con imputazioni in R

Avanzato4 h

Diagnostica, visualizza e gestisci i dati mancanti con diverse tecniche di imputazione e consigli per migliorare i tuoi risultati.

R4 h13 video49 esercizi4,200 XP6,238Attestato di conseguimento

Crea il tuo account gratuito

Continua con Google
o
Continuando, accetti i nostri Condizioni d'uso, il nostro Informativa sulla privacy e che i tuoi dati siano archiviati negli USA.

Amato da studenti in migliaia di aziende

Descrizione del corso

I dati mancanti sono ovunque. Il processo di riempire i valori assenti si chiama imputazione, e saperlo fare correttamente è una competenza essenziale se vuoi ottenere previsioni accurate e distinguerti. In questo corso imparerai a usare visualizzazioni e test statistici per riconoscere gli schemi di dati mancanti e a imputare i dati utilizzando una serie di modelli statistici e di Machine Learning. Svilupperai anche capacità decisionali, utili per scegliere il metodo di imputazione più adatto in una determinata situazione. Infine, imparerai a incorporare l’incertezza derivante dall’imputazione nelle tue inferenze e previsioni, rendendole più robuste e affidabili.

Prerequisiti

Curriculum

Programma del corso

1

Il problema dei dati mancanti

2

Imputazione basata su donatori

Conosci la tassonomia dei metodi di imputazione e impara tre tecniche basate su donatori: imputazione con media, hot-deck e k-Nearest-Neighbors. Guarderai sotto il cofano per vedere come funzionano questi metodi, per poi imparare ad applicarli a un insieme di dati meteorologici tropicali reali. Lungo il percorso, scoprirai anche trucchi utili per farli funzionare ancora meglio sui tuoi problemi.
Inizia capitolo
3

Imputazione basata su modelli

È il momento di imparare a usare modelli statistici e di Machine Learning, come regressione lineare, regressione logistica e random forests, per imputare i dati mancanti. In questo capitolo analizzerai come i modelli producono le loro previsioni e userai questa conoscenza per estrarre i valori imputati da distribuzioni condizionali. Questo è importante perché garantisce imputazioni più varie e plausibili, rendendole più simili ai dati reali.
Inizia capitolo
4

Incertezza dell’imputazione

I valori imputati non sono scolpiti nella pietra. Sono solo stime, e le stime comportano una certa incertezza. In questo capitolo finale scoprirai come il bootstrapping e le equazioni concatenate con il pacchetto mice possono essere usati per incorporare l’incertezza dell’imputazione nei tuoi modelli e nelle tue analisi, rendendoli più affidabili e robusti.
Inizia capitolo
R

Gestione dei dati mancanti con imputazioni in R

Corso
completato

Ottieni l'attestato di completamento

Iscriviti ora

Aumenta le tue competenze sui dati con l'app di DataCamp

Avanza ovunque ti trovi con i nostri corsi per dispositivi mobili e le nostre sfide di programmazione quotidiane da 5 minuti.