Este tópico descreve os algoritmos de mascaramento de dados compatíveis com o Data Security Center (DSC).
Categoria | Descrição | Algoritmo | Entrada | Dados sensíveis e cenário aplicáveis |
Hashing | Não é possível recuperar os dados originais após a desidentificação com este tipo de algoritmo. Indicado para proteção de senhas ou cenários que exigem verificação de sensibilidade dos dados por comparação. Use algoritmos de hash comuns e especifique um valor de salt. | MD5 | Valor de salt |
|
Secure Hash Algorithm 1 (SHA-1) | Valor de salt | |||
SHA-256 | Valor de salt | |||
Hash-based Message Authentication Code (HMAC) | Valor de salt | |||
Ocultação com asteriscos (*) ou cerquilhas (#) | Os dados originais não podem ser recuperados após a desidentificação com este tipo de algoritmo. Adequado para cenários em que dados sensíveis precisam ser exibidos em uma interface de usuário ou compartilhados com terceiros. Este algoritmo oculta textos especificados nos dados sensíveis substituindo-os por asteriscos (*) ou cerquilhas (#). | Mantém os primeiros N caracteres e os últimos M caracteres | Valores de N e M |
|
Mantém os caracteres da posição X até a posição Y | Valores de X e Y | |||
Oculta os primeiros N caracteres e os últimos M caracteres | Valores de N e M | |||
Oculta os caracteres da posição X até a posição Y | Valores de X e Y | |||
Oculta os caracteres anteriores a um caractere especial na primeira ocorrência desse caractere | Arroba (@), e comercial (&) ou ponto (.) | |||
Oculta os caracteres posteriores a um caractere especial na primeira ocorrência desse caractere | Arroba (@), e comercial (&) ou ponto (.) | |||
Substituição (com suporte a personalização) | É possível recuperar os dados originais após a desidentificação com alguns desses algoritmos. Utilize este tipo de algoritmo para desidentificar campos com formatos fixos, como números de documentos de identidade. O algoritmo substitui todo o valor ou parte dele por um valor mapeado usando uma tabela de mapeamento, permitindo a recuperação dos dados originais. Também é possível substituir valores total ou parcialmente de forma aleatória, com base em um intervalo aleatório; nesse caso, os dados originais não podem ser recuperados. O DSC oferece várias tabelas de mapeamento integradas e permite personalizar algoritmos de substituição. | Substitui conteúdo específico em números de documentos de identidade por valores mapeados | Tabela de mapeamento para substituição de IDs de regiões administrativas |
|
Substitui aleatoriamente conteúdo específico em números de documentos de identidade | Tabela de códigos para substituição aleatória de IDs de regiões administrativas | |||
Substitui aleatoriamente conteúdo específico em IDs de cartões de identificação militar | Tabela de códigos para substituição aleatória de códigos de tipo | |||
Substitui aleatoriamente conteúdo específico em números de passaporte | Tabela de códigos para substituição aleatória de campos de finalidade | |||
Substitui aleatoriamente conteúdo específico em números de permissão de Permissões de Entrada e Saída para Viagens entre Hong Kong e Macau | Tabela de códigos para substituição aleatória de campos de finalidade | |||
Substitui aleatoriamente conteúdo específico em números de cartão bancário | Tabela de códigos para substituição aleatória de Bank Identification Numbers (BINs) | |||
Substitui aleatoriamente conteúdo específico em números de telefone fixo | Tabela de códigos para substituição aleatória de IDs de regiões administrativas | |||
Substitui aleatoriamente conteúdo específico em números de celular | Tabela de códigos para substituição aleatória de códigos de rede móvel | |||
Substitui aleatoriamente conteúdo específico em códigos unificados de crédito social | Tabela de códigos para substituição aleatória de IDs de autoridades de registro, tabela de códigos para substituição aleatória de códigos de tipo e tabela de códigos para substituição aleatória de IDs de regiões administrativas | |||
Substitui conteúdo específico em tabelas gerais por valores mapeados | Tabela de mapeamento para substituição de letras maiúsculas, tabela de mapeamento para substituição de letras minúsculas, tabela de mapeamento para substituição de dígitos e tabela de mapeamento para substituição de caracteres especiais | |||
Substitui aleatoriamente conteúdo específico em tabelas gerais | Tabela de códigos para substituição aleatória de letras maiúsculas, tabela de códigos para substituição aleatória de letras minúsculas, tabela de códigos para substituição aleatória de dígitos e tabela de códigos para substituição aleatória de caracteres especiais | |||
Arredondamento | É possível recuperar os dados originais após a desidentificação com alguns desses algoritmos. Recomendado para análise e coleta de estatísticas em conjuntos de dados sensíveis. O DSC fornece dois tipos de algoritmos de arredondamento. Um deles arredonda números e datas, impedindo a recuperação dos dados originais após a desidentificação. O outro desloca bits em texto, permitindo a recuperação dos dados originais. | Arredonda números | Os números são arredondados para o N-ésimo dígito antes do ponto decimal. Valores válidos de N: 1 a 19. |
|
Arredonda datas | As datas são arredondadas para o nível de year, month, day, hour ou minute. | |||
Desloca caracteres | Número de posições para mover bits específicos e direção do deslocamento (esquerda ou direita) | |||
Criptografia | Os dados originais podem ser recuperados após a desidentificação com este tipo de algoritmo. Projetado para criptografar campos sensíveis que exigem recuperação posterior. Compatível com algoritmos comuns de criptografia simétrica. | Algoritmo Data Encryption Standard (DES) | Chave de criptografia |
|
Algoritmo Triple Data Encryption Standard (3DES) | Chave de criptografia | |||
Algoritmo Advanced Encryption Standard (AES) | Chave de criptografia | |||
Embaralhamento | Não é possível recuperar os dados originais após a desidentificação com este tipo de algoritmo. Mais indicado para desidentificar colunas de dados estruturados. O algoritmo extrai valores de um campo em um intervalo especificado da tabela source e os reorganiza em uma coluna específica. Alternativamente, seleciona valores aleatoriamente de uma coluna dentro do intervalo de valores e os reorganiza. Dessa forma, os valores são misturados e desidentificados. | Embaralha dados aleatoriamente | Método de embaralhamento: reorganização ou seleção aleatória |
|