Hoppa till huvudinnehållet

Kurs

Hantera saknade värden i R

Grundläggande4 tim

Gör det enkelt att visualisera, utforska och imputera saknade data med naniar, ett tidyverse-vänligt sätt att hantera saknade data.

R4 tim14 videor52 övningar4,350 XP17,305Intyg om fullgjord kurs

Skapa ditt kostnadsfria konto

Fortsätt med Google
eller
Genom att fortsätta godkänner du våra Användarvillkor, vår Integritetspolicy och att dina data lagras i USA.

Älskad av elever på tusentals företag

Utbildar ett team?

Prova för företag

Kursbeskrivning

Saknade data är en del av all verklig dataanalys. De kan dyka upp på oväntade ställen och göra analyser svåra att tolka. I den här kursen lär du dig att använda tidyverse-verktyg och R-paketet naniar för att visualisera saknade värden. Du hanterar saknade värden så att de kan användas i analyser, och utforskar dem för att hitta snedvridningar i datan. Slutligen avslöjar du andra underliggande mönster i saknandet. Du lär dig också att "fylla i luckorna" med imputationsmodeller och hur du visualiserar, utvärderar och fattar beslut baserade på dessa imputerade datamängder.

Förkunskapskrav

Kursplan

Kursöversikt

1

Varför bry sig om saknade data?

Kapitel 1 introducerar dig till saknade data och förklarar vad saknade värden är, hur de fungerar i R, hur du identifierar dem och hur du räknar dem. Sedan introducerar vi sammanfattningar av saknade data och hur du summerar saknandet över observationer och variabler, samt hur du utforskar det inom olika grupper i datan. Slutligen tar vi upp visualisering av saknade data: hur du skapar översiktliga visualiseringar för hela datamängden och för variabler, observationer och andra sammanfattningar, samt hur du utforskar dessa inom olika grupper.
Starta kapitel
2

Bearbeta och städa upp saknade värden

I kapitel två lär du dig att hitta dolda saknade värden som "missing" eller "N/A" och ersätta dem med `NA`. Du lär dig att effektivt hantera implicita saknade värden – det vill säga värden som är underförstått saknade men inte uttryckligen listade. Vi tar också upp beroende i saknade data och diskuterar Missing Completely at Random (MCAR), Missing At Random (MAR), Missing Not At Random (MNAR) och vad dessa innebär för din dataanalys.
Starta kapitel
3

Testa samband i saknandet

I det här kapitlet lär du dig arbetsflöden för att hantera saknade data. Vi introducerar särskilda datastrukturer – skuggmatrisen och nabular-data – och visar hur du använder dem i arbetsflöden för att utforska saknade data, så att du kan koppla sammanfattningar av saknandet tillbaka till faktiska värden i datan. Du lär dig att använda ggplot för att utforska och visualisera hur värden förändras när andra variabler saknas. Slutligen lär du dig att visualisera saknandet över två variabler, och hur och varför du bör visualisera saknade värden i ett spridningsdiagram.
Starta kapitel
4

Koppla ihop delarna (imputation)

I det här kapitlet lär du dig att fylla i saknade värden i din data – något som kallas imputation. Du lär dig att imputera och spåra saknade värden, samt vilka styrkor och svagheter olika imputationsmetoder har, så att du kan utforska, visualisera och utvärdera de imputerade värdena mot de ursprungliga. Du lär dig att använda, utvärdera och jämföra olika imputationsmodeller, och utforska hur de påverkar de slutsatser du kan dra från modellerna.
Starta kapitel
R

Hantera saknade värden i R

Kurs
slutförd

Tjäna intyg om genomförande

Registrera dig nu

Utveckla dina datakunskaper med DataCamp för mobil

Ta dig framåt var du än är med våra mobilkurser och dagliga 5-minuterskodningsutmaningar.