Sari la conținutul principal

Curs

Procesarea scalabilă a datelor în R

Avansat4 h

Învață să scrii cod scalabil pentru lucrul cu big data în R folosind pachetele bigmemory și iotools.

R4 h15 videoclipuri49 exerciții3,950 XP6,208Certificat de realizare

Creează-ți contul gratuit

Continuă cu Google
sau
Continuând, accepți Termenii de utilizare, Politica de confidențialitate și faptul că datele tale sunt stocate în SUA.

Apreciat de cursanți din mii de companii

Instruiești o echipă?

Încearcă pentru companii

Descrierea cursului

Seturile de date sunt adesea mai mari decât memoria RAM disponibilă, ceea ce creează probleme pentru programatorii R, deoarece implicit toate variabilele sunt stocate în memorie. Vei învăța instrumente pentru procesarea, explorarea și analiza datelor direct de pe disc. Vei implementa și abordarea split-apply-combine și vei învăța cum să scrii cod scalabil folosind pachetele bigmemory și iotools. În cadrul acestui curs, vei lucra cu datele Agenției Federale pentru Finanțarea Locuințelor – un set de date public care înregistrează toate creditele ipotecare deținute sau securitizate de Federal National Mortgage Association (Fannie Mae) și Federal Home Loan Mortgage Corporation (Freddie Mac) în perioada 2009–2015.

Cerințe prealabile

Programă

Planul cursului

1

Lucrul cu seturi de date din ce în ce mai mari

În acest capitol, vom explica de ce este nevoie de tehnici noi atunci când seturile de date depășesc memoria RAM disponibilă. Vom arăta că importul și exportul datelor cu funcțiile de bază din R pot fi lente și vom prezenta câteva soluții simple. În final, vom face cunoștință cu pachetul bigmemory.
Începe capitolul
R

Procesarea scalabilă a datelor în R

Curs
finalizat

Obține diploma de absolvire

Înscrie-te acum

Dezvoltă-ți competențele în date cu DataCamp for Mobile

Fă progrese din mers cu cursurile noastre pentru mobil și provocările zilnice de programare de 5 minute.