Sari la conținutul principal

Curs

Procesarea scalabilă a datelor în R

Avansat4 h

Învață să scrii cod scalabil pentru lucrul cu big data în R folosind pachetele bigmemory și iotools.

R4 h{count, plural, one {# video} few {# videoclipuri} other {# de videoclipuri}}{count, plural, one {# exercițiu} few {# exerciții} other {# de exerciții}}3,950 XP6,184Declarație de finalizare

Creează-ți contul gratuit

Continuă cu Google
sau
Continuând, accepți Termeni de utilizare, al nostru Politica de confidențialitate și că datele tale sunt stocate în SUA.

Iubit de cursanți din mii de companii

Instruiești o echipă?

Încearcă pentru business

Descrierea cursului

Seturile de date sunt adesea mai mari decât memoria RAM disponibilă, ceea ce creează probleme pentru programatorii R, deoarece implicit toate variabilele sunt stocate în memorie. Vei învăța instrumente pentru procesarea, explorarea și analiza datelor direct de pe disc. Vei implementa și abordarea split-apply-combine și vei învăța cum să scrii cod scalabil folosind pachetele bigmemory și iotools. În cadrul acestui curs, vei lucra cu datele Agenției Federale pentru Finanțarea Locuințelor – un set de date public care înregistrează toate creditele ipotecare deținute sau securitizate de Federal National Mortgage Association (Fannie Mae) și Federal Home Loan Mortgage Corporation (Freddie Mac) în perioada 2009–2015.

Cerințe prealabile

Curriculum

Structura cursului

1

Lucrul cu seturi de date din ce în ce mai mari

În acest capitol, vom explica de ce este nevoie de tehnici noi atunci când seturile de date depășesc memoria RAM disponibilă. Vom arăta că importul și exportul datelor cu funcțiile de bază din R pot fi lente și vom prezenta câteva soluții simple. În final, vom face cunoștință cu pachetul bigmemory.
Începe capitolul
R

Procesarea scalabilă a datelor în R

Curs
finalizat

Obține Declarația de Realizare

Înscrie-te acum

Dezvoltă-ți competențele în date cu DataCamp pentru mobil

Progresează oricând cu cursurile noastre mobile și provocările zilnice de programare de 5 minute.

Procesarea scalabilă a datelor în R | DataCamp