k-anonimato é uma propriedade que indica a capacidade de reidentificação dos registros de um conjunto de dados. Um conjunto de dados é k-anônimo quando os semi-identificadores de cada pessoa contida nele são idênticos a uma quantidade de, no mínimo, k – 1 outra pessoa também contida no conjunto.
É possível calcular o valor de k-anonimato com base em uma ou mais colunas ou campos de um conjunto de dados. Neste tópico, demonstramos como calcular valores de k-anonimato para um conjunto de dados usando a Proteção de dados sensíveis. Para mais informações sobre k-anonimato ou análise de risco em geral, consulte o tópico sobre o conceito de análise de risco antes de continuar.
Antes de começar
Antes de continuar, verifique se você fez o seguinte:
- Faça login na sua Conta do Google.
- No console do Google Cloud , na página do seletor de projetos, selecione ou crie um projeto do Google Cloud . Acessar o seletor de projetos
- Verifique se o faturamento foi ativado para o projeto Google Cloud . Saiba como confirmar se a cobrança está ativada para seu projeto.
- Ative a proteção de dados sensíveis. Ativar a Proteção de Dados Sensíveis
- Selecione um conjunto de dados do BigQuery para a análise. A Proteção de Dados Sensíveis calcula a métrica k-anonimato verificando uma tabela do BigQuery.
- Determine um identificador (se aplicável) e pelo menos um semi-identificador no conjunto de dados. Para mais informações, consulte Termos e técnicas de análise de risco.
Calcular o k-anonimato
A Proteção de Dados Sensíveis realiza a análise de risco sempre que um job de análise de risco é executado. É preciso criar o job primeiro, usando o console doGoogle Cloud , enviando uma solicitação de API DLP ou usando uma biblioteca de cliente da Proteção de Dados Sensíveis.
Console
No console do Google Cloud , acesse a página Criar análise de risco.
Na seção Escolher dados de entrada, especifique a tabela do BigQuery a ser verificada inserindo o ID do projeto que contém a tabela, o ID do conjunto de dados e o nome da tabela.
Em Métrica de privacidade a calcular, selecione k-anonimato.
Na seção código da tarefa, é possível atribuir um identificador personalizado ao job e selecionar um local de recursos em que a Proteção de Dados Sensíveis vai processar seus dados. Quando terminar, clique em Continuar.
Na seção Definir campos, especifique identificadores e semi-identificadores para o job de risco k-anonimato. A Proteção de dados sensíveis acessa os metadados da tabela do BigQuery especificada na etapa anterior e tenta preencher a lista de campos.
- Marque a caixa de seleção apropriada para especificar um campo como identificador (ID) ou semi-identificador (QI). É preciso selecionar 0 ou 1 identificador e pelo menos um semi-identificador.
- Se a Proteção de dados sensíveis não conseguir preencher os campos, clique em Inserir nome do campo para inserir manualmente um ou mais campos e definir cada um deles como identificador ou semi-identificador. Quando terminar, clique em Continuar.
Na seção Adicionar ações, é possível adicionar ações opcionais que serão realizadas quando o job de risco for concluído. As opções disponíveis são estas:
- Salvar no BigQuery: salva os resultados da verificação de análise de risco em uma tabela do BigQuery.
Publicar no Pub/Sub: publica uma notificação em um tópico do Pub/Sub.
Notificar por e-mail: envia um e-mail com resultados. Quando terminar, clique em Criar.
O job de análise de risco de k-anonimato começará imediatamente.
C#
Para saber como instalar e usar a biblioteca de cliente da proteção de dados sensíveis, consulte Bibliotecas de cliente da proteção de dados sensíveis.
Para autenticar na Proteção de dados sensíveis, configure o Application Default Credentials. Para mais informações, consulte Configurar a autenticação para um ambiente de desenvolvimento local.