Ir al contenido principal

Curso

Procesamiento de datos escalable en R

Avanzado4 h

Aprende a escribir código escalable para trabajar con big data en R utilizando los paquetes bigmemory e iotools.

R4 h15 vídeos49 ejercicios3,950 XP6,184Certificado de logro

Crea tu cuenta gratis

Continuar con Google
o
Al continuar, aceptas nuestros los Términos de uso, nuestro la Política de privacidad y que tus datos se almacenan en EE. UU.

Les encanta a estudiantes de miles de empresas

¿Formando a un equipo?

Prueba para empresas

Descripción del curso

A menudo, los conjuntos de datos son más grandes que la RAM disponible, lo que genera problemas para quienes programan en R, ya que por defecto todas las variables se almacenan en memoria. Aprenderás herramientas para procesar, explorar y analizar datos directamente desde disco. También implementarás el enfoque dividir-aplicar-combinar y aprenderás a escribir código escalable usando los paquetes bigmemory e iotools. En este curso, utilizarás los datos de la Federal Housing Finance Agency, un conjunto de datos público que recoge todas las hipotecas mantenidas o titulizadas por Federal National Mortgage Association (Fannie Mae) y Federal Home Loan Mortgage Corporation (Freddie Mac) entre 2009 y 2015.

Requisitos previos

Programa de formación

Contenido del curso

1

Trabajo con conjuntos de datos cada vez más grandes

En este capítulo, veremos por qué necesitas aplicar nuevas técnicas cuando los conjuntos de datos son más grandes que la RAM disponible. Mostramos que importar y exportar datos con las funciones base de R puede ser lento y algunas formas sencillas de solucionarlo. Por último, presentamos el paquete bigmemory.
Empezar capítulo
R

Procesamiento de datos escalable en R

Curso
completado

Obtén el certificado de logro

Inscríbete ahora

Desarrolla tus habilidades con la aplicación móvil de DataCamp

Progresa sobre la marcha con nuestros cursos móviles y desafíos diarios de 5 minutos.