Criar uma política de correspondência

Aplica-se:SQL Server

Importante

O DQS (Data Quality Services) é removido no SQL Server 2025 (17.x). Continuamos a dar suporte ao DQS no SQL Server 2022 (16.x) e versões anteriores.

Este tópico descreve como criar uma política de correspondência em uma base de conhecimento no Data Quality Services (DQS). Você se prepara para o processo de correspondência no DQS executando a atividade de Política de Correspondência em dados de exemplo. Nesta atividade, você cria e testa uma ou mais regras de correspondência na política e depois publica a base de dados de conhecimento para tornar as regras de correspondência publicamente disponíveis para uso. Pode haver apenas uma política de correspondência em uma base de dados de conhecimento, mas essa política pode conter várias regras de correspondência.

A criação de política de correspondência é executada em três estágios: um processo de mapeamento no qual você identifica a fonte de dados e mapeia os domínios para colunas, um processo de política de correspondência no qual você cria uma ou mais regras de correspondência e testa cada regra de correspondência separadamente e um processo de resultados de correspondência no qual você executa todas as regras de correspondência em conjunto e, caso fique satisfeito com elas, adiciona a política à base de dados de conhecimento. Cada um desses processos é executado em uma página separada do assistente da atividade de Política de Correspondência, permitindo que você navegue entre as diferentes páginas, execute novamente o processo e encerre um processo específico de política de correspondência para depois retornar ao mesmo estágio desse processo. Depois de testar todas as regras em conjunto, se desejar, você poderá retornar à página Política de Correspondência , ajustar uma regra individual, testá-la separadamente outra vez e retornar à página Resultados de Correspondência para executar todas as regras em conjunto mais uma vez. O DQS fornece estatísticas sobre a fonte de dados, as regras de correspondência e os resultados de correspondência que permitem a você tomar decisões conscientes sobre a política de correspondência, para que seja possível refiná-la.

Pré-requisitos

Se os dados de origem estiverem em um arquivo Excel, o Microsoft Excel deverá estar instalado no computador do Data Quality Client. Caso contrário, você não poderá selecionar o arquivo do Excel no estágio de mapeamento. Os arquivos criados pelo Microsoft Excel podem ter a extensão .xlsx, .xls ou .csv. Se a versão de 64 bits do Excel for usada, somente arquivos do Excel 2003 (.xls) terão suporte; não haverá suporte para os arquivos do Excel 2007 ou 2010 (.xlsx). Se você estiver usando a versão de 64 bits do Excel 2007 ou 2010, salve o arquivo como .xls ou .csv ou instale uma versão de 32 bits do Excel.

Permissões

Você deve ter a função dqs_kb_editor ou dqs_administrator no banco de dados DQS_MAIN para criar uma política de correspondência.

Como definir parâmetros de regra de correspondência

A criação de uma regra de correspondência é um processo interativo no qual você insere os fatores usados para determinar se um registro é uma correspondência para outro. Você pode inserir condições para qualquer domínio em uma tabela. Quando o DQS executa a correspondência em dois registros, ele comparará os valores nos campos mapeados para os domínios incluídos na regra de correspondência. O DQS analisa os valores em cada campo na regra e, em seguida, usa os fatores inseridos na regra para cada domínio para calcular uma pontuação de correspondência final. Se a pontuação de correspondência dos dois registros comparados for maior que a pontuação de correspondência mínima, os dois campos serão considerados correspondências.

Os fatores que você insere em uma regra de correspondência incluem os seguintes:

  • Peso: para cada domínio na regra, insira um peso numérico que determine como a análise de correspondência do domínio será comparada com a de cada um dos outros domínios na regra. O peso indica a contribuição da pontuação do campo para a pontuação geral de correspondência entre dois registros. As pontuações calculadas atribuídas a cada campo de origem são somadas para se obter uma pontuação de correspondência composta para os dois registros. Para cada campo que não é um pré-requisito (com similaridade exata ou semelhante), defina o peso entre 10 e 100. A soma dos pesos dos domínios que não são pré-requisitos deve ser igual a 100. Se o valor for um pré-requisito, o peso será definido como 0 e não poderá ser alterado.

  • Similaridade exata: Selecione Exato se os valores no mesmo campo de dois registros diferentes precisarem ser idênticos para que sejam considerados uma correspondência. Se forem idênticos, a pontuação de correspondência para esse domínio será definida como "100", e o DQS usará essa pontuação e as pontuações dos outros domínios na regra para determinar a pontuação total de correspondência. Se não forem idênticos, a pontuação de correspondência para esse domínio será definida como "0" e o processamento da regra prosseguirá para a próxima condição. Se você configurar uma regra de correspondência para um domínio numérico e selecionar Similar, poderá inserir uma tolerância como um percentual ou um número inteiro. Para um domínio do tipo data, você pode inserir uma tolerância como dia, mês ou ano (inteiro) se selecionar Similar; não há nenhuma tolerância percentual para um domínio de data. Se você selecionar Exato, não terá essa opção.

  • Similaridade de similar: selecione Similar se dois valores no mesmo campo de dois registros diferentes puderem ser considerados uma correspondência, mesmo que os valores não sejam idênticos. Quando o DQS executa a regra, ele calculará uma pontuação de correspondência para esse domínio e utilizará essa pontuação e as pontuações dos outros domínios na regra para determinar a pontuação de correspondência de agregação. A similaridade mínima entre os valores de um campo é 60%. Se a pontuação de correspondência calculada para um campo de dois registros for inferior a 60, a pontuação de similaridade será definida automaticamente como 0. Se você estiver configurando uma regra de correspondência para um campo numérico e selecionar Similar, poderá inserir uma tolerância como um percentual ou um número inteiro. Se você estiver configurando uma regra de correspondência para um campo de data e selecionar Similar, poderá inserir uma tolerância numérica.

  • Pré-requisito: selecione Pré-requisito para especificar que os valores no mesmo campo em dois registros diferentes devem retornar uma correspondência de 100% ou os registros não serão considerados uma correspondência e as outras cláusulas na regra serão desconsideradas. Quando a opção Pré-requisito está selecionada, o campo de peso do domínio é removido de forma que você não pode definir um peso para o domínio. Você deve redefinir um ou mais pesos de domínio para que a soma dos pesos seja igual a 100. Os domínios de pré-requisitos não contribuem para a pontuação de correspondência de registros. A pontuação de correspondência de registro é determinada pela comparação dos valores nos campos para os quais a Similaridade está definida como Similar ou Exata. Quando você define um campo como pré-requisito, a Similaridade desse domínio é definida automaticamente como Exato.

A pontuação mínima de correspondência é o limite a partir do qual dois registros são considerados correspondentes (e o status desses registros é definido como "Correspondência encontrada"). Insira um valor inteiro em incrementos de "1" ou clique na seta para cima ou para baixo para aumentar ou diminuir o valor em incrementos de "10". O valor mínimo é 80. Se a pontuação de correspondência for inferior a 80, os dois registros não serão considerados correspondentes. Você não pode alterar o intervalo da pontuação de correspondência mínima nessa página. A pontuação de correspondência mínima é 80. Você pode, no entanto, alterar a pontuação de correspondência mínima mais baixa na página Administração (se for um administrador do DQS).

A criação de uma regra de correspondência é um processo iterativo, porque talvez você precise alterar os pesos relativos dos domínios na regra, a similaridade ou a propriedade de pré-requisito de um domínio, ou a pontuação mínima de correspondência da regra, para obter os resultados de que você precisa. Talvez você também ache que precisa criar várias regras, sendo que cada uma será executada para criar a pontuação correspondente. Pode ser difícil obter o resultado necessário com uma regra apenas. Várias regras oferecerão visualizações diferentes de uma correspondência obrigatória. Com várias regras, você poderá incluir menos domínios em cada regra, usar pesos mais altos para cada domínio e obter resultados melhores. Se os dados forem menos precisos e menos completos, talvez sejam necessárias mais regras para encontrar as correspondências necessárias. Se os dados estiverem mais precisos e completos, você precisará de menos regras.

A definição de perfil fornece informações sobre completude e unicidade. Considere a completude e a exclusividade em conjunto. Use os dados de completude e unicidade para determinar qual peso atribuir a um campo no processo de correspondência. Se houver um nível alto de exclusividade em um campo, o uso de um campo em uma política de correspondência poderá diminuir os resultados de correspondência, de modo que talvez você queira definir o peso desse campo para um valor relativamente pequeno. Se houver um nível baixo de exclusividade para uma coluna, porém baixa integridade, talvez você não queira incluir um domínio para essa coluna. Com um nível baixo de exclusividade, porém um nível alto de integridade, talvez você queira incluir o domínio. Algumas colunas, como gênero, podem naturalmente ter um baixo nível de unicidade. Para obter mais informações, consulte as abas Criador de Perfil e Resultados.

Primeira etapa: como iniciar uma política de correspondência

Você executa a atividade de política de conciliação na área de gerenciamento da base de conhecimento do aplicativo do Data Quality Client.

  1. Iniciar o Cliente Data Quality. Para obter informações sobre como fazer isso, consulte Executar o aplicativo do Data Quality Client.

  2. Na tela inicial do Data Quality Client, clique em Nova base de conhecimento para criar uma política de conciliação em uma nova base de conhecimento. Insira um nome para a base de dados de conhecimento, insira uma descrição e defina Criar base de dados de conhecimento de conforme desejar. Clique na Política de Correspondência para a atividade. Clique em Avançar para continuar.

  3. Clique em Abrir base de dados de conhecimento para criar ou modificar a política de correspondência em uma base de dados de conhecimento existente. Selecione a base de dados de conhecimento, selecione Política de Correspondênciae clique em Avançar. Também é possível clicar em uma base de dados de conhecimento em Base de Dados de Conhecimento Recente. Se você abrir uma base de dados de conhecimento que foi fechada quando uma política de correspondência estava sendo trabalhada, prosseguirá para o estágio em que a atividade de política de correspondência foi fechada (conforme indicado pela coluna Estado da base de dados de conhecimento na tabela de base de dados de conhecimento ou no nome da base de dados de conhecimento em Base de Dados de Conhecimento Recente). Se você abrir uma base de conhecimento que inclua uma política de correspondência e já tiver sido concluída, você será direcionado para a página Política de correspondência. Se você abrir uma base de conhecimento que não inclua uma política de correspondência e estiver concluída, você irá para a página Mapeamento.

Estágio de mapeamento

No estágio de mapeamento, identifique a origem dos dados para os quais você criará a política de correspondência e mapeie colunas de origem para domínios para tornar os domínios disponíveis para a atividade de política correspondente.

  1. Na página Mapa , para criar uma política para um banco de dados, deixe a Fonte de Dados como SQL Server, selecione o banco de dados para o qual deseja criar a política em Banco de dadose selecione a tabela ou exibição em Tabela/Exibição. O banco de dados de origem deve estar presente na mesma instância do SQL Server que o Data Quality Server. Caso contrário, ele não será exibido na lista suspensa.

  2. Para criar uma política para os dados em uma planilha do Excel, selecione Arquivo do Excel como Fonte de Dados, clique em Procurar e selecione o arquivo do Excel e deixe a opção Usar primeira linha como cabeçalho selecionada se apropriado. Em Planilha, selecione a planilha no arquivo do Excel que será a origem dos dados. O Microsoft Excel deverá ser instalado no computador Cliente Data Quality para selecionar um arquivo do Excel. Caso contrário, o botão Procurar não estará disponível e você será notificado sob esta caixa de texto de que o Microsoft Excel não está instalado.

  3. Em Mapeamentos, selecione um campo para Coluna de Origeme clique no ícone Criar Domínio .

  4. Em Mapeamentos, selecione um campo na fonte de dados para Coluna de Origeme selecione o domínio correspondente. Repita para todos os domínios que você usa no processo de correspondência. Crie domínios conforme necessário clicando em Criar um Domínio ou Criar um Domínio Composto.

    Observação

    Você poderá mapear sua fonte de dados para um domínio DQS enquanto cria uma política de correspondência somente se o tipo de dados de origem tiver suporte no DQS e corresponder ao tipo de dados de domínio do DQS. Para obter mais informações sobre tipos de dados que oferecem suporte no DQS, consulte O SQL Server com suporte e tipos de dados do SSIS para domínios do DQS.

  5. Clique no controle mais (+) para adicionar uma linha à tabela Mapeamentos ou no controle menos (-) para remover uma linha.

  6. Clique em Visualizar fonte de dados para visualizar os dados na tabela do SQL Server ou visualizar os dados selecionados ou a planilha do Excel selecionada.

  7. Clique em Exibir/Selecionar Domínios Compostos para exibir uma lista dos domínios compostos disponíveis na base de dados de conhecimento e selecione conforme apropriado para mapeamento.

  8. Clique em Avançar para prosseguir para a etapa de política de correspondência.

    Observação

    Clique em Fechar para salvar o estágio do projeto correspondente e retornar à página inicial do DQS. Na próxima vez que você abrir este projeto, ele começará na mesma etapa. Clique em Cancelar para encerrar a atividade de correspondência, perder seu trabalho com isso e retornar à página inicial do DQS.

Fase da Política de Correspondência

Você cria regras de correspondência e as testa individualmente na página de Política de Correspondência. Quando testar uma regra de correspondência na página Política de Correspondência , você visualizará uma tabela de resultados de correspondência que mostra os clusters que o DQS identificou para a regra selecionada. A tabela mostra cada registro no cluster com os valores de domínio de mapeamento e a pontuação de correspondência, além do registro pivô inicial do cluster. Também é possível exibir os dados de análise do processo de correspondência como um todo, as condições em cada regra de correspondência e as estatísticas dos resultados de cada regra de correspondência separadamente. Você pode filtrar pelos dados da regra principal que quiser.

Para obter mais informações sobre como as regras de correspondência funcionam, consulte Como definir parâmetros de regra de correspondência.

  1. Na página Política de Correspondência , clique no ícone Criar uma regra de correspondência .

  2. Digite um nome e uma descrição para a regra.

  3. Aumente o valor de Pontuação mínima de correspondência se você quiser tornar os requisitos de correspondência mais estritos. Para obter mais informações sobre a pontuação de correspondência mínima, consulte Como definir parâmetros de regra de correspondência.

  4. Clique no ícone Adicionar um novo elemento de domínio .

  5. Selecione um domínio ou um domínio composto para inserir os valores da regra.

    Observação

    Você só poderá selecionar um domínio composto se cada domínio único no domínio composto tiver sido mapeado para uma coluna de origem.

  6. Para Similaridade, selecione Similar se dois valores no mesmo campo de dois registros diferentes puderem ser considerados uma correspondência, mesmo que os valores não sejam idênticos. Selecione Exato se dois valores no mesmo campo de dois registros diferentes tiverem que ser idênticos para ser considerados uma correspondência. (Para obter mais informações, consulte Como definir parâmetros de regra de correspondência.)

  7. Em Peso, insira um valor que determina a contribuição da pontuação de correspondência de um domínio para a pontuação geral de correspondência de dois registros.

    Observação

    Quando você define um peso para um domínio composto, pode inserir um peso diferente para cada domínio único no domínio composto, caso em que o domínio composto não recebe um peso separado, ou pode inserir um peso único para o domínio composto no qual os domínios únicos no domínio composto não recebem pesos separados.

  8. Selecione Pré-requisito para especificar que os valores do campo em dois registros diferentes devem retornar uma correspondência de 100% ou os registros não serão considerados uma correspondência e as outras cláusulas na regra serão desconsideradas. Se a Similaridade for Similar, ela será alterada para Exata e o peso será removido, pois a correspondência deve ser de 100%.

  9. Repita as etapas 4 a 8 para todos os outros domínios que farão parte da regra de correspondência. Verifique se a soma de pesos para todos os domínios na regra é igual a 100.

  10. Selecione Clusters sobrepostos na lista suspensa para exibir os registros pivô e os registros subsequentes de todos os clusters quando a correspondência for realizada, mesmo que grupos de clusters tenham registros em comum. Selecione Clusters não sobrepostos para exibir clusters que têm registros em comum como um único cluster quando a correspondência é executada.

  11. Clique em Recarregar dados da origem para copiar dados da origem de dados para a tabela de preparação e reindexar esses dados quando você executar a política de correspondência. Clique em Executar com dados anteriores para executar uma política de correspondência sem copiar os dados para a tabela de preparação nem reindexá-los. A opção Executar nos dados anteriores fica desativada na primeira execução da política de correspondência ou se você alterar o mapeamento na página Mapeamento e depois clicar em Sim na janela pop-up exibida em seguida. Em ambos os casos, você deverá reindexar. Não será necessário reindexar se a política de correspondência não tiver sido alterada. Executar com base em dados anteriores pode melhorar o desempenho.

  12. Clique em Iniciar para executar o processo de correspondência para a regra selecionada. Quando o processo for concluído, a tabela exibirá o ID do Registro, o número do Cluster e as colunas de dados (incluindo aquelas que não estão na regra de correspondência) para cada registro em um cluster. A linha pivô no cluster é considerada a candidata principal a sobreviver ao processo de desduplicação. Cada linha adicional em um cluster é considerada uma duplicata; sua pontuação de correspondência (em comparação com o registro pivô) é fornecida na tabela de resultados. O número do cluster é o mesmo que a ID do registro pivô no cluster.

  13. Você pode trabalhar com os dados na tabela Resultados de Correspondência da seguinte forma:

    • Em Filtro, selecione Correspondente para mostrar todas as linhas correspondentes e sua pontuação. As linhas que não são consideradas correspondências (ou seja, que têm uma pontuação de correspondência inferior à pontuação mínima de correspondência) não são exibidas na tabela de resultados de correspondência. Selecione Sem correspondência para mostrar todas as linhas sem correspondência, não as linhas correspondentes.

    • Na caixa suspensa Percentual, selecione um percentual na lista suspensa, em incrementos de "5". Todas as linhas com uma pontuação correspondente maior ou igual ao percentual serão exibidas na tabela de resultados correspondente.

    • Se você clicar duas vezes em um registro na tabela de resultados de correspondência, o DQS exibirá uma janela pop-up Detalhes da Pontuação de Correspondência que mostra o registro pivô e o registro de origem (e os valores em todos os seus campos), a pontuação entre eles e um detalhamento da correspondência entre os registros. A busca detalhada exibe os valores em cada campo do registro dinâmico e no registro de origem para que você possa compará-los e mostra a pontuação de correspondência com a qual cada campo contribui para a pontuação de correspondência geral para os dois registros.

  14. Visualize as estatísticas nas guias Profiler e Resultados da correspondência para garantir que você esteja obtendo os resultados de que precisa. Para obter mais informações, consulte as abas Profiler e Results.

  15. Se for necessário alterar a regra, altere-a no Editor de Regra e clique em Reiniciar.

    Observação

    Após a conclusão da primeira análise, o botão Iniciar se transforma no botão Reiniciar. Se os resultados da análise anterior ainda não tiverem sido salvos, clicar em Reiniciar causará a perda dos dados anteriores. Durante a execução da análise, não saia da página; do contrário, o processo de análise será encerrado.

  16. A aba Resultados da correspondência exibe estatísticas das duas execuções mais recentes da regra. Se você executou a regra de correspondência mais de uma vez com configurações diferentes, compare as estatísticas da regra atual e da regra anterior. Se você descobrir que os resultados da regra anterior eram melhores, clique em Restaurar regra anterior para restaurar as condições da regra anterior, retornando a regra para seu estado anterior antes de editar. As condições de regra atuais serão perdidas. Isso permite a você ajustar a política com base nas duas últimas execuções de correspondência, diminuindo o tempo que passa ajustando a política de correspondência.

  17. Se você quiser que outra regra seja adicionada à política de correspondência, repita a partir da etapa 1.

  18. Clique em Avançar para prosseguir para o estágio de resultados de correspondência.

Estágio de Resultados de Correspondência

Teste todas as suas regras de correspondência de uma só vez na página Resultados de Correspondência. Antes de fazer isso, especifique se a execução do teste de regra identificará os clusters sobrepostos ou não sobrepostos. Se você estiver executando as regras várias vezes, poderá executar as regras em dados recarregados da origem ou em dados anteriores.

Quando testar as regras de correspondência na página Resultados de Correspondência , você visualizará uma tabela de resultados de correspondência que mostra os clusters que o DQS identificou para todas as regras. A tabela mostra cada registro no cluster com os valores de domínio de mapeamento e a pontuação de correspondência, além do registro pivô inicial do cluster. Também é possível exibir os dados de análise de perfil das regras de correspondência como um todo, das condições em cada regra de correspondência e as estatísticas dos resultados de todas as regras de correspondência.

  1. Na página Resultados da correspondência, selecione Clusters sobrepostos na lista suspensa para exibir os registros pivô e os registros subsequentes de todos os clusters quando a correspondência é executada, mesmo que grupos de clusters tenham registros em comum. Selecione Clusters não sobrepostos para exibir clusters que têm registros em comum como um único cluster quando a correspondência é executada.

  2. Clique em Recarregar dados da origem para copiar dados da origem de dados para a tabela de preparação e reindexar esses dados quando você executar a política de correspondência. Clique em Executar com dados anteriores para executar uma política de correspondência sem copiar os dados para a tabela de preparação nem reindexá-los. A opção Executar nos dados anteriores fica desativada na primeira execução da política de correspondência ou se você alterar o mapeamento na página Mapeamento e depois clicar em Sim na janela pop-up exibida em seguida. Em ambos os casos, você deverá reindexar. Não será necessário reindexar se a política de correspondência não tiver sido alterada. Executar com base em dados anteriores pode melhorar o desempenho.

  3. Clique em Iniciar para executar o processo de correspondência para todas as regras que você definiu. A tabela Resultados de Correspondência exibe a ID do registro, o número do cluster e as colunas de dados (incluindo aquelas que não estão na regra de correspondência) para cada registro em um cluster. O registro principal no cluster é selecionado aleatoriamente. (Você determina o registro sobrevivente ao selecionar a regra de sobrevivência na página Exportar ao executar o projeto de correspondência.) Cada linha adicional em um grupo é considerada uma duplicata; sua pontuação de correspondência (em comparação com o registro pivô) é fornecida na tabela de resultados.

  4. Você pode trabalhar com os dados na tabela Resultados de Correspondência da seguinte forma:

    • Em Filtro, selecione Correspondente para mostrar todas as linhas correspondentes e sua pontuação. As linhas que não são consideradas correspondências (que têm uma pontuação correspondente inferior à pontuação correspondente mínima) não são mostradas na tabela de resultados correspondente. Selecione Sem correspondência para mostrar todas as linhas sem correspondência, não as linhas correspondentes.

    • Na caixa suspensa Percentual, selecione um percentual na lista suspensa, em incrementos de "5". Todas as linhas com uma pontuação correspondente maior ou igual ao percentual serão exibidas na tabela de resultados correspondente.

    • Se você clicar duas vezes em um registro na tabela de resultados da correspondência, o DQS exibirá um pop-up Detalhes da Pontuação de Correspondência que mostra o registro pivô e o registro de origem (e os valores em todos os seus campos), a pontuação entre eles e um detalhamento da correspondência entre os registros. A busca detalhada exibe os valores em cada campo do registro dinâmico e no registro de origem para que você possa compará-los e mostra a pontuação de correspondência com a qual cada campo contribui para a pontuação de correspondência geral para os dois registros.

  5. Exiba as estatísticas nas guias Criador de perfil e Resultados de Correspondência para assegurar que você esteja obtendo os resultados necessários. Clique na guia Regras de Correspondência para visualizar quais são as configurações de domínio para cada regra. Para obter mais informações, consulte as abas Profiler e Results.

  6. Se você não estiver satisfeito com os resultados de todas as regras, clique em Voltar para retornar à página Política de Correspondência , modifique uma ou mais regras conforme o necessário, volte à página Resultados de Correspondência e clique em Reiniciar.

    Observação

    Após a conclusão da análise, o botão Iniciar se transforma em um botão Reiniciar . Se os resultados da análise anterior ainda não tiverem sido salvos, clicar em Reiniciar causará a perda dos dados anteriores.

  7. Se você estiver satisfeito com os resultados de todas as regras, clique em Concluir para concluir o processo de política de correspondência e clique em um dos seguintes:

    • Sim – Publique a base de dados de conhecimento e saia: a base de dados de conhecimento será publicada para uso do usuário atual ou de outros usuários. A base de dados de conhecimento não será bloqueada, o estado da base de dados de conhecimento (na tabela de bases de dados de conhecimento) será definido como vazio e as atividades de Gerenciamento de Domínio e Descoberta da Base de Dados de Conhecimento estarão disponíveis. Você será retornado à tela Abrir Base de Dados de Conhecimento.

    • Não – Salve o trabalho na base de dados de conhecimento e saia: seu trabalho será salvo, a base de dados de conhecimento permanecerá bloqueada e o estado da base de dados de conhecimento será definido como Em serviço. As atividades de Gerenciamento de Domínio e Descoberta da Base de Dados de Conhecimento estarão disponíveis. Você será redirecionado à página inicial.

    • Cancelar – Mantenha-se na tela atual: o pop-up será fechado e você será retornado para a tela Gerenciamento de Domínio.

  8. Clique em Fechar para salvar seu trabalho e retornar para a página inicial do DQS. O estado da base de dados de conhecimento mostrará a cadeia de caracteres "Política de Correspondência – " e o estado atual. Se você clicou em Fechar quando estava na tela Resultado de Correspondência , o estado mostrará: "Política de Correspondência - Resultados". Se você clicou em fechar enquanto estava na tela Política de Correspondência, o estado exibirá: "Política de Correspondência - Política de Correspondência". Depois de clicar em Fechar, para realizar a atividade Descoberta de Conhecimento, você terá que retornar à atividade Política de correspondência, clicar em Concluir e, em seguida, clicar em Sim para publicar a base de conhecimento ou em Não para salvar o trabalho na base de conhecimento e sair.

    Observação

    Se você clicar em Fechar quando um processo de correspondência estiver em execução, o processo de correspondência não terminará quando clicar em Fechar. Você pode reabrir a base de dados de conhecimento e verificar se o processo ainda está em execução ou, caso tenha sido concluído, se os resultados foram exibidos. Se o processo não foi concluído, a tela exibirá o progresso.

  9. Clique em Cancelar para encerrar a atividade de política de correspondência, descartar seu trabalho e voltar à página inicial do DQS.

Acompanhamento: após criar uma política de correspondência

Depois de criar uma política de correspondência, você pode executar um projeto de correspondência a partir da base de dados de conhecimento que contém a política de correspondência. Para obter mais informações, consulte Executar um projeto de correspondência.

Abas Perfilador e Resultados

As guias Profiler e Resultados contêm estatísticas para as páginas de Política de correspondência e de Resultados da correspondência.

Guia Criador de perfil

Clique na guia Criador de perfil para exibir estatísticas sobre o banco de dados de origem e para cada campo incluído na regra de política. As estatísticas serão atualizadas à medida que a regra de política for executada.

Para obter mais informações sobre como interpretar as estatísticas a seguir, consulte Como definir parâmetros de regra de correspondência.

As estatísticas do banco de dados de origem incluem o seguinte:

  • Registros: o número total de registros no banco de dados de origem

  • Valores Totais: o número total de valores nos campos da fonte de dados

  • Novos Valores: o número total de valores novos desde a execução anterior e seu percentual em relação ao todo

  • Valores Exclusivos: o número total de valores exclusivos nos campos e seu percentual em relação ao todo

  • Novos Valores Exclusivos: o número total de valores exclusivos novos nos campos e seu percentual em relação ao todo

As estatísticas de campo incluem o seguinte:

  • Nome do campo

  • Nome de domínio

  • Novo: o número de novos valores e o percentual de novos valores em comparação com os valores existentes no domínio

  • Exclusivo: o número de registros exclusivos no campo e seu percentual do total

  • Integridade: a integridade de cada campo de origem mapeado para o exercício de correspondência

Notificações de correspondência de políticas

Para a atividade de política de correspondência, as seguintes condições resultam em notificações:

  • O campo está vazio em todos os registros; é recomendável eliminá-lo do mapeamento.

  • A pontuação de integridade de campo é muito baixa; talvez você queira eliminá-lo do mapeamento.

  • Todos os valores em um campo são inválidos; você deve verificar o mapeamento e a relevância das regras de domínio para o conteúdo do campo.

  • Há um nível baixo de valores válidos no campo; você deve verificar o mapeamento e a relevância das regras de domínio para o conteúdo do campo.

  • Há um nível alto de exclusividade neste campo. Usar este campo na política de correspondência pode reduzir os resultados de correspondência.

Aba de Resultados Correspondentes

Clique na guia Resultados de Correspondência para exibir estatísticas para a execução da regra de política de correspondência e a execução da regra anterior. Se você executou a mesma regra mais de uma vez com parâmetros diferentes, a tabela de resultados de correspondência exibirá estatísticas de ambas as execuções, permitindo a comparação delas. Você também poderá restaurar a regra anterior se quiser.

As estatísticas incluem o seguinte:

  • O número total de registros no banco de dados

  • O número total de registros de correspondência no banco de dados

  • O número de registros no banco de dados que não são considerados duplicatas

  • O número de clusters descobertos

  • O tamanho médio do cluster (número de registros duplicados dividido pelo número de clusters)

  • O menor número de duplicatas em um cluster

  • O maior número de duplicatas em um cluster