Ir al contenido principal

Curso

Privacidad de datos y anonimización en Python

Avanzado4 h

Aprende a procesar información confidencial con técnicas que preservan la privacidad.

Python4 h16 vídeos49 ejercicios3,850 XP3,788Certificado de logro

Crea tu cuenta gratis

Continuar con Google
o
Al continuar, aceptas nuestros los Términos de uso, nuestro la Política de privacidad y que tus datos se almacenan en EE. UU.

Les encanta a estudiantes de miles de empresas

¿Formando a un equipo?

Prueba para empresas

Descripción del curso

La privacidad de los datos nunca ha sido tan importante. Pero ¿cómo equilibrar la privacidad con la necesidad de obtener y compartir valiosos insights empresariales? En este curso aprenderás a hacerlo, usando los mismos métodos que emplean Google y Amazon —incluida la generalización de datos y modelos de privacidad como k-Anonymity y differential privacy—. Además de tratar temas como el RGPD, también descubrirás cómo crear y entrenar modelos de Machine Learning en Python protegiendo información sensible de los usuarios, como datos de empleados o ingresos. ¡Vamos allá!

Requisitos previos

Programa de formación

Contenido del curso

1

Introducción a la privacidad de datos

Prepárate para aplicar técnicas de anonimización como supresión de datos, enmascaramiento, generación de datos sintéticos y generalización. En este capítulo, aprenderás a distinguir entre información personal identificable (PII) sensible y no sensible, cuasiidentificadores y los conceptos básicos del RGPD. También verás ejemplos reales de lo que puede salir mal si no sigues estas buenas prácticas.
Empezar capítulo
2

Más técnicas de preservación de la privacidad

Descubre cómo anonimizar datos muestreando de conjuntos de datos según la distribución de probabilidad de las columnas. Después aprenderás a aplicar el modelo de privacidad k-anonymity para evitar ataques de vinculación o reidentificación y a usar jerarquías para realizar generalización de datos en variables categóricas.
Empezar capítulo
3

Privacidad diferencial

4

Anonimización y publicación de conjuntos de datos

En este capítulo final, aprenderás a aplicar métodos de reducción de dimensionalidad como el análisis de componentes principales (PCA) para anonimizar conjuntos de datos grandes con muchas columnas. Luego usarás Faker para generar conjuntos de datos realistas y coherentes, y scikit-learn para crear conjuntos de datos sintéticos que sigan una distribución normal. Por último, pondrás en práctica todo lo aprendido en el curso combinando múltiples técnicas para publicar conjuntos de datos de forma segura.
Empezar capítulo

Privacidad de datos y anonimización en Python

Curso
completado

Obtén el certificado de logro

Inscríbete ahora

Desarrolla tus habilidades con la aplicación móvil de DataCamp

Progresa sobre la marcha con nuestros cursos móviles y desafíos diarios de 5 minutos.