Pular para o conteúdo principal

Curso

Privacidade de Dados e Anonimização em Python

Avançado4 h

Aprenda a lidar com informações confidenciais usando técnicas que protegem a privacidade.

Python4 h16 vídeos49 exercícios3,850 XP3,790Declaração de aproveitamento

Crie sua conta gratuita

Continuar com o Google
ou
Ao continuar, você aceita nossos Termos de uso, nosso Política de privacidade e que seus dados sejam armazenados nos EUA.

Amado por alunos em milhares de empresas

Treinando um time?

Teste para empresas

Descrição do curso

A privacidade de dados nunca foi tão importante. Mas como equilibrar a privacidade com a necessidade de coletar e compartilhar insights valiosos para o negócio? Neste curso, você vai aprender exatamente isso, usando os mesmos métodos do Google e da Amazon — incluindo generalização de dados e modelos de privacidade, como k-Anonymity e privacidade diferencial. Além de abordar temas como a GDPR, você também vai descobrir como criar e treinar modelos de Machine Learning em Python protegendo informações sensíveis dos usuários, como dados de funcionários e rendimentos. Vamos começar!

Pré-requisitos

Programa de estudos

Conteúdo do curso

1

Introdução à Privacidade de Dados

Prepare-se para aplicar técnicas de anonimização como supressão de dados, mascaramento, geração de dados sintéticos e generalização. Neste capítulo, você vai aprender a diferenciar informações pessoais identificáveis (PII) sensíveis e não sensíveis, quase-identificadores e o básico da GDPR. Você também verá exemplos reais do que pode dar errado se essas boas práticas não forem seguidas.
Começar capítulo
2

Técnicas Avançadas de Preservação de Privacidade

Descubra como anonimizar dados amostrando conjuntos de dados conforme a distribuição de probabilidade das colunas. Em seguida, você vai aprender a aplicar o modelo de privacidade k-anonymity para prevenir ataques de vinculação ou reidentificação e usar hierarquias para realizar generalização de dados em variáveis categóricas.
Começar capítulo
3

Privacidade Diferencial

4

Anonimização e Publicação de Conjuntos de Dados

Neste capítulo final, você vai aprender a aplicar métodos de redução de dimensionalidade, como a Análise de Componentes Principais (PCA), para anonimizar grandes conjuntos de dados com muitas colunas. Em seguida, você usará o Faker para gerar conjuntos de dados realistas e consistentes e o scikit-learn para criar conjuntos de dados sintéticos que seguem uma distribuição normal. Por fim, você vai juntar tudo o que aprendeu no curso ao combinar várias técnicas para liberar conjuntos de dados ao público com segurança.
Começar capítulo

Privacidade de Dados e Anonimização em Python

Curso
concluído

Obtenha o certificado de conclusão

Inscreva-se agora

Desenvolva suas habilidades em dados com o DataCamp for Mobile

Continue progredindo em qualquer lugar com nossos cursos e desafios diários de programação de 5 minutos.