Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
Este artigo descreve como você pode criar classificações personalizadas no Mapa de Dados do Microsoft Purview para definir tipos de dados em seu patrimônio de dados que são exclusivos para sua organização. Ele também descreve a criação de regras de classificação personalizadas que permitem encontrar dados especificados em todo o seu acervo de dados.
Importante
Para criar uma classificação personalizada, você precisa de permissão de curador de dados ou administrador de fonte de dadosem um domínio ou coleção. As permissões em qualquer nível de coleção são suficientes.
Classificações de sistema padrão
O Mapa de Dados fornece um grande conjunto de classificações de sistema padrão que representam tipos de dados pessoais típicos que você pode ter em seu acervo de dados. Consulte a lista de classificações de sistema disponíveis no Mapa de Dados.
Você também tem a capacidade de criar classificações personalizadas, se alguma das classificações padrão não atender às suas necessidades.
Observação
- Nossas regras de amostragem de dados são aplicadas a classificações personalizadas e de sistema.
- As classificações personalizadas são aplicadas apenas a fontes de dados estruturados, como SQL e CosmosDB, e a tipos de arquivo estruturados, como CSV, JSON e Parquet. A classificação personalizada não é aplicada a tipos de arquivo de dados não estruturados, como DOC, PDF e XLSX.
Etapas para criar uma classificação personalizada
Para criar uma classificação personalizada, siga estas etapas:
Você precisará de permissões de curador de dados ou administrador de fonte de dados em qualquer coleção para poder criar uma classificação personalizada.
No portal do Microsoft Purview, abra a solução Mapa de dados .
Selecione Gerenciamento de anotações , selecione Classificações.
Selecione + Novo.
O painel Adicionar nova classificação é aberto, no qual você pode dar um nome e uma descrição à sua classificação. É recomendável usar uma convenção de espaçamento entre nomes, como your company name.classification name.
As classificações do sistema Microsoft são agrupadas no namespace reservado MICROSOFT. . Um exemplo é a MICROSOFT. GOVERNO. EUA. SOCIAL_SECURITY_NUMBER.
O nome da sua classificação deve começar com uma letra seguida por uma sequência de letras, números e caracteres de ponto (.) ou sublinhado. À medida que você digita, a experiência do usuário gera automaticamente um nome amigável. Esse nome amigável é o que os usuários veem quando você o aplica a um ativo no catálogo.
Para manter o nome curto, o sistema cria o nome amigável com base na seguinte lógica:
Todos, exceto os dois últimos segmentos do namespace, são cortados.
O uso de maiúsculas e minúsculas é ajustado para que a primeira letra de cada palavra seja maiúscula.
Todos os sublinhados (_) são substituídos por espaços.
Por exemplo, se você nomeou seu contoso.hr.employee_ID de classificação, o nome amigável será armazenado no sistema como Hr.Employee ID.
Selecione OK e sua nova classificação será adicionada à sua lista de classificação personalizada .
Selecionar a classificação na lista abre a página de detalhes da classificação. Aqui, você encontra todos os detalhes sobre a classificação.
Esses detalhes incluem a contagem de quantas instâncias existem, o nome formal, as regras de classificação associadas (se houver) e o nome do proprietário.
Regras de classificação personalizadas
O mapa de dados fornece um conjunto de regras de classificação padrão que são usadas pelo scanner para detectar automaticamente determinados tipos de dados. Você também pode adicionar suas próprias regras de classificação personalizadas para detectar outros tipos de dados que talvez seja do seu interesse encontrar em seu acervo de dados. Esse recurso pode ser eficiente quando você está tentando localizar dados em seu acervo de dados.
Observação
As regras de classificação personalizadas só têm suporte no idioma inglês.
Por exemplo, digamos que uma empresa chamada Contoso tenha IDs de funcionários que são padronizadas em toda a empresa com a palavra "Funcionário" seguida por um GUID para criar EMPLOYEE{GUID}. Por exemplo, uma instância de uma ID de funcionário se parece com EMPLOYEE9c55c474-9996-420c-a285-0d0fc23f1f55.
A Contoso pode configurar o sistema de verificação para localizar instâncias dessas IDs criando uma regra de classificação personalizada. Eles podem fornecer uma expressão regular que corresponda ao padrão de dados, nesse caso, \^Employee\[A-Za-z0-9\]{8}-\[A-Za-z0-9\]{4}-\[A-Za-z0-9\]{4}-\[A-Za-z0-9\]{4}-\[A-Za-z0-9\]{12}\$. Opcionalmente, se os dados geralmente estão em uma coluna da qual eles sabem o nome, como Employee_ID ou EmployeeID, eles podem adicionar uma expressão regular de padrão de coluna para tornar a verificação ainda mais precisa. Um exemplo de regex é Employee_ID|EmployeeID.
O sistema de verificação pode então usar essa regra para examinar os dados reais na coluna e o nome da coluna para tentar identificar cada instância de onde o padrão de ID do funcionário é encontrado.
Etapas para criar uma regra de classificação personalizada
Crie uma classificação personalizada que siga as instruções na seção anterior. Você adicionará essa classificação personalizada à configuração da regra de classificação para que o sistema a aplique quando encontrar uma correspondência na coluna.
No portal do Microsoft Purview, abra a solução Mapa de dados .
Em Gerenciamento de anotações, selecione a seção Regras de classificação .
Selecione Novo.
A caixa de diálogo Nova regra de classificação é aberta. Preencha os campos e decida se deseja criar uma regra de expressão regular ou uma regra de dicionário.
Campo Descrição Nome Obrigatório. O máximo é de 100 caracteres. Descrição Opcional. O máximo é de 256 caracteres. Nome da classificação Obrigatório. Selecione o nome da classificação na lista suspensa para dizer ao scanner para aplicá-la se uma correspondência for encontrada. Estado Obrigatório. As opções são habilitadas ou desabilitadas. Habilitado é o padrão.
Criando uma regra de expressão regular
Importante
Expressões regulares em classificações personalizadas não diferenciam maiúsculas de minúsculas.
Se estiver criando uma regra de expressão regular, você verá a tela a seguir. Você poderá, opcionalmente, carregar um arquivo que será usado para gerar padrões regex sugeridos para sua regra. Há suporte apenas para regras em inglês.
Se você decidir gerar um padrão regex sugerido, depois de carregar um arquivo, selecione um dos padrões sugeridos e selecione Adicionar aos Padrões para usar os dados sugeridos e os padrões de coluna. Você pode ajustar os padrões sugeridos ou também digitar seus próprios padrões sem fazer upload de um arquivo.
Campo Descrição Padrão de Dados Opcional. Uma expressão regular que representa os dados armazenados no campo de dados. O limite é grande. No exemplo anterior, os padrões de dados testam uma ID de funcionário que é literalmente a palavra Employee{GUID}.Padrão de Coluna Opcional. Uma expressão regular que representa os nomes de coluna que você deseja corresponder. O limite é grande. Em Padrão de dados , você pode usar o limite mínimo de correspondência para definir a porcentagem mínima de correspondências de valores de dados distintos em uma coluna que deve ser encontrada pelo verificador para que a classificação seja aplicada. O valor sugerido é de 60%. Se você especificar vários padrões de dados, essa configuração será desabilitada e o valor será fixado em 60%.
Observação
O limite mínimo de correspondência deve ser pelo menos 1%.
Agora você pode verificar sua regra e criá-la .
Teste a regra de classificação antes de concluir o processo de criação para validar se ela aplicará tags aos seus ativos. As classificações na regra serão aplicadas aos dados de exemplo carregados da mesma forma que em uma verificação. Isso significa que todas as classificações do sistema e sua classificação personalizada corresponderão aos dados no seu arquivo.
Os arquivos de entrada podem incluir arquivos delimitados (CSV, PSV, SSV, TSV), conteúdo JSON ou XML. O conteúdo será analisado com base na extensão do arquivo de entrada. Os dados delimitados podem ter uma extensão de arquivo que corresponda a qualquer um dos tipos mencionados. Por exemplo, os dados TSV podem existir em um arquivo chamado MySampleData.csv. O conteúdo delimitado também deve ter no mínimo três colunas.
Criando uma regra de dicionário
Se estiver criando uma regra de dicionário, você verá a tela a seguir. Carregue um arquivo que contenha todos os valores possíveis para a classificação que você está criando em uma única coluna. Há suporte apenas para regras em inglês.
Depois que o dicionário for gerado, você poderá ajustar o limite mínimo de correspondência e enviar a regra.
Editar ou excluir uma classificação personalizada
Para atualizar ou editar uma classificação personalizada, siga estas etapas:
No portal do Microsoft Purview, abra a solução Mapa de dados .
Em Gerenciamento de anotações , selecione Classificações.
Selecione a guia Personalizado .
Selecione a classificação que deseja editar e, em seguida, selecione o botão Editar .
Agora pode editar a descrição desta classificação personalizada. Selecione o botão Ok quando terminar para salvar suas alterações.
Para excluir uma classificação personalizada:
- Depois de abrir o Mapa de dados e, em seguida, Classificações, selecione a guia Personalizado .
- Selecione a classificação que você deseja excluir ou várias classificações que deseja excluir e, em seguida, selecione o botão Excluir .
Você também pode editar ou excluir uma classificação de dentro da própria classificação. Basta selecionar sua classificação e, em seguida, selecionar os botões Editar ou Excluir no menu superior.
Habilitar ou desabilitar regras de classificação
Em sua conta do Microsoft Purview, selecione o Mapa de dados e, em seguida, Regras de classificação.
Selecione a guia Personalizado .
Você pode marcar o status atual de uma regra de classificação examinando a coluna Status na tabela.
Selecione a regra de classificação, ou várias regras de classificação, que você deseja habilitar ou desabilitar.
Selecione os botões Ativar ou Desativar no menu superior.
Você também pode atualizar o status de uma regra ao editá-la.
Editar ou excluir uma regra de classificação
Para atualizar ou editar uma regra de classificação personalizada, siga estas etapas:
Em sua conta do Microsoft Purview, selecione o Mapa de dados e, em seguida, Regras de classificação.
Selecione a guia Personalizado .
Selecione a regra de classificação que deseja editar e, em seguida, selecione o botão Editar .
Agora você pode editar o estado, a descrição e a regra de classificação associada.
Selecione o botão Continuar .
Você pode carregar um novo arquivo para sua expressão regular ou regra de dicionário corresponder e atualizar o limite de correspondência e a correspondência de padrão de coluna.
Selecione Aplicar para salvar as alterações. As verificações precisarão ser executadas novamente com a nova regra para aplicar alterações em seus ativos.
Para excluir uma classificação personalizada:
Depois de abrir o Mapa de dados e, em seguida, Regras de classificação, selecione a guia Personalizado .
Selecione a regra de classificação que você deseja excluir e, em seguida, selecione o botão Excluir .
Próximas etapas
Agora que você criou sua regra de classificação, ela está pronta para ser adicionada a um conjunto de regras de varredura para que sua varredura use a regra durante a varredura. Para obter mais informações, consulte Criar um conjunto de regras de verificação.