Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
Este guia ajuda você a começar a monitorar grupos de disponibilidade e a solucionar alguns dos problemas comuns em grupos de disponibilidade. Ele oferece conteúdo original e uma página inicial com informações úteis que são publicadas em outros lugares. Embora este guia não possa discutir completamente todas as questões que podem ocorrer na grande área de grupos de disponibilidade, ele pode indicar a direção certa na sua análise das causas raiz e na resolução dos problemas.
Como os grupos de disponibilidade são uma tecnologia integrada, muitos problemas que você encontra podem ser sintomas de outros problemas no seu sistema de banco de dados. Alguns problemas são causados por configurações dentro de um grupo de disponibilidade, como um banco de dados de disponibilidade sendo suspenso. Outros problemas podem incluir problemas com outros aspectos do SQL Server, como configurações do SQL Server, implantações de arquivos de banco de dados e questões sistêmicas de desempenho não relacionadas à disponibilidade. Outros problemas podem existir fora do SQL Server, como problemas de I/O de rede, TCP/IP, Active Directory e Clustering de Failover do Windows Server (WSFC). Frequentemente, problemas que surgem em um grupo de disponibilidade, réplica ou banco de dados exigem que você teste várias tecnologias para identificar a causa raiz.
Cenários de solução de problemas
A tabela a seguir contém links para os cenários comuns de solução de problemas para grupos de disponibilidade. Eles são categorizados por seus tipos de cenários, como configuração, conectividade do cliente, failover e desempenho.
| Scenario | Tipo de cenário | Description |
|---|---|---|
| Solucionar problemas na configuração dos Grupos de Disponibilidade Sempre Ligados (SQL Server) | Configuração | Fornece informações para ajudar você a resolver problemas típicos na configuração de instâncias de servidores para grupos de disponibilidade. Os problemas de configuração típicos incluem: - grupos de disponibilidade são desativados - contas estão configuradas incorretamente - o endpoint de espelhamento de banco de dados não existe - o endpoint está inacessível (SQL Server Erro 1418) - acesso à rede não existe - um comando de entrada no banco de dados falha (erro do SQL Server 35250) |
| Solucionar problemas em uma operação de arquivo de adição falhada (Grupos de Disponibilidade Sempre Ligados) | Configuração | Uma operação de adição de arquivo fez com que o banco de dados secundário fosse suspenso e ficasse no estado NÃO SINCRONIZADO. |
| Não é possível conectar ao ouvinte de grupo de disponibilidade em um ambiente multi-sub-net | Conectividade do cliente | Depois de configurar o ouvinte do grupo de disponibilidade, você não consegue mais ping para o ouvinte ou conectar a ele a partir de uma aplicação. |
| Solução de problemas falhada em failovers automáticos | Failover | Um failover automático não foi concluído com sucesso. |
| Solução de problemas: o grupo de disponibilidade excedeu o RTO | Performance | Após um failover automático ou um failover manual planejado sem perda de dados, o tempo de failover excede o RTO. Ou, quando você calcula o tempo de failover de uma réplica secundária de confirmação síncrona (como um parceiro de failover automático), você descobre que ele excede o RTO. |
| Solução de problemas: o grupo de disponibilidade excedeu o RPO | Performance | Depois de executar um failover manual forçado, a perda de dados é maior que o RPO. Ou, ao calcular a possível perda de dados de uma réplica secundária de confirmação assíncrona, você descobre que ela excede o RPO. |
| Solucionar problemas: as alterações na réplica primária não são refletidas na réplica secundária | Performance | O aplicativo cliente conclui uma atualização na réplica primária com êxito, mas consultar a réplica secundária mostra que a alteração não é refletida. |
| Solução de Problemas: Tipo de espera HADR_SYNC_COMMIT alta com Grupos de Disponibilidade Sempre Ligados | Performance | Se HADR_SYNC_COMMIT for incomumente longo, há um problema de desempenho no fluxo de movimento de dados ou no endurecimento de logarígrafos de réplicas secundárias. |
Ferramentas úteis para solução de problemas
Ao configurar ou rodar grupos de disponibilidade, diferentes ferramentas podem ajudar a diagnosticar diferentes tipos de problemas. A tabela a seguir fornece links para informações úteis sobre as ferramentas.
| Ferramenta | Description |
|---|---|
| Usar o Painel AlwaysOn (SQL Server Management Studio) | Reporta uma visão rápida da saúde do seu grupo de disponibilidade em uma interface amigável. |
| Políticas de Sempre Ligado | Usado pelo Painel Always On. |
| Registro de Erros do SQL Server (Grupos de Disponibilidade Sempre Ativos) | Os logs registram eventos de transição de estado para grupos de disponibilidade, réplicas e bancos de dados, status de outros componentes Always On e erros de Always On. |
| CONFUSÃO. LOG (Grupos de Disponibilidade Sempre Ativados) | Logs agrupam eventos, incluindo transições de estado do recurso do grupo de disponibilidade, bem como eventos e erros da DLL de recursos do SQL Server. |
| Registro de diagnósticos de saúde Always On | Logs SQL Server diagnósticos de saúde conforme reportados ao cluster WSFC (DLL de recursos SQL Server) por sp_server_diagnostics (Transact-SQL). |
| Visualizações de gerenciamento dinâmica e visualizações de catálogo de sistemas (Grupos de Disponibilidade Sempre Ligados) | Reporta informações sobre os grupos de disponibilidade, como configuração, estado de saúde e métricas de desempenho. |
| Eventos estendidos do Always On | Fornece diagnósticos detalhados dos grupos de disponibilidade e é útil para análise da causa raiz. |
| Tipos que sempre estão esperando | Fornece estatísticas de espera específicas para grupos de disponibilidade e são úteis para ajustes de desempenho. |
| Contadores de desempenho Always On | A atividade dos grupos de disponibilidade do monitor é refletida no System Monitor e é útil para ajuste de desempenho. Para mais informações, veja SQL Server, objeto Availability Replica e SQL Server, objeto Database Replica. |
| Buffers de anel sempre ligados | Registrar alertas dentro do sistema SQL Server para diagnósticos internos e pode ser usado para depurar problemas relacionados aos grupos de disponibilidade. |
Grupos de disponibilidade de monitores
O momento ideal para diagnosticar um grupo de disponibilidade é antes que um problema exija um failover, seja automático ou manual. Isso pode ser feito monitorando as métricas de desempenho do grupo de disponibilidade e enviando alertas quando as réplicas de disponibilidade estão funcionando fora dos limites do seu acordo de nível de serviço (SLA). Por exemplo, se uma réplica secundária síncrona tiver problemas de desempenho que façam o tempo estimado de failover aumentar, você não quer esperar até que ocorra um failover automático e descubra que esse tempo excede seu objetivo de tempo de recuperação.
Como os grupos de disponibilidade são soluções de alta disponibilidade e recuperação de desastres, as métricas de desempenho mais importantes a serem monitoradas são o tempo estimado de failover, que afeta seu objetivo de tempo de recuperação (RTO), e a possível perda de dados em um desastre, que afeta seu objetivo de ponto de recuperação (RPO). Você pode coletar essas métricas a partir dos dados que o SQL Server expõe a qualquer momento, para que você possa ser alertado sobre um problema nas capacidades de alta disponibilidade e recuperação de desastres (HADR) do seu sistema antes que eventos reais de falha ocorram. Portanto, é importante se familiarizar com o processo de sincronização de dados dos grupos de disponibilidade e coletar as métricas de acordo.
Esta tabela abaixo indica artigos que podem ajudar a monitorar a saúde da solução dos seus grupos de disponibilidade.
| Artigo | Description |
|---|---|
| Monitore o desempenho para Grupos de Disponibilidade Sempre Ativos | Descreve o processo de sincronização de dados para grupos de disponibilidade, as portas de controle de fluxo e métricas úteis ao monitorar um grupo de disponibilidade; e também mostra como coletar métricas de RTO e RPO. |
| Monitoramento de grupos de disponibilidade (SQL Server) | Fornece informações sobre ferramentas para monitorar um grupo de disponibilidade. |
| O modelo de saúde Always On, parte 1: Arquitetura do modelo de saúde | Fornece uma visão geral do modelo de saúde Always On. |
| O modelo de saúde Always On, parte 2: Estendendo o modelo de saúde | Mostra como personalizar o modelo de saúde Sempre Ligado e o Painel Sempre Ativo para mostrar informações extras. |
| Monitorando a saúde sempre ligada com o PowerShell, parte 1: Visão geral básica do cmdlet | Fornece uma visão geral básica dos cmdlets Always On do PowerShell que podem ser usados para monitorar a saúde de um grupo de disponibilidade. |
| Monitorando a saúde sempre ligada com PowerShell, parte 2: Uso avançado de cmdlets | Fornece informações sobre o uso avançado dos cmdlets Always On do PowerShell para monitorar a saúde de um grupo de disponibilidade. |
| Monitorando a Saúde Sempre Ligada com o PowerShell, parte 3: Uma aplicação simples de monitoramento | Mostra como monitorar automaticamente um grupo de disponibilidade com uma aplicação. |
| Monitoramento de Saúde Sempre Ligado com PowerShell, parte 4: Integração com SQL Server Agent | Fornece informações sobre como integrar o monitoramento de grupos de disponibilidade com o SQL Server Agent e configurar notificações para as partes apropriadas quando surgem problemas. |