O grupo de disponibilidade Always On está offline

Aplica-se:SQL Server

Introdução

  • Nome da Política: Status Online do Grupo de Disponibilidade
  • Problema: o grupo de disponibilidade está offline.
  • Categoria: crítica
  • Facet: grupo de disponibilidade

DESCRIÇÃO

Esta política verifica se o grupo de disponibilidade está online ou offline. A política está em um estado não saudável, e um alerta é gerado quando o recurso de cluster do grupo de disponibilidade está offline ou quando o grupo de disponibilidade não tem uma réplica primária.

O estado da política será íntegro quando o recurso de cluster do grupo de disponibilidade estiver online e o grupo de disponibilidade tiver uma réplica primária.

Possíveis causas

Esse problema pode ser causado por uma falha na instância de servidor que hospeda a réplica primária ou pelo recurso de grupo de disponibilidade WSFC (Windows Server Failover Cluster) que entra offline. Estas são as possíveis causas do grupo de disponibilidade estar offline:

  • O grupo de disponibilidade não está configurado com o modo de failover automático. A réplica primária torna-se indisponível e a função de todas as réplicas do grupo de disponibilidade torna-se RESOLVING.

    • O serviço da instância de réplica principal está indisponível ou não está respondendo.

    • O grupo de disponibilidade tem um problema de conectividade com o cluster.

  • O grupo de disponibilidade está configurado para o modo de failover automático e não é concluído com sucesso.

    • Durante o failover automático, a verificação de prontidão primária na réplica de destino falha e não há réplica disponível para se tornar a nova primária.
  • O recurso de grupo de disponibilidade no cluster fica offline.

    • Qualquer recurso de cluster dependente encontra um problema crítico e se torna offline. O recurso de grupo de disponibilidade também permanece offline até que o recurso dependente ficar online.

    • Um problema crítico no cluster desabilita o recurso do grupo de disponibilidade.

  • Há um failover automático, manual ou forçado em andamento no grupo de disponibilidade.

Soluções possíveis

Estas são as possíveis soluções para este problema:

  • Se a instância do SQL Server da réplica primária estiver inativa, reinicie o servidor e verifique se o grupo de disponibilidade recupera o estado íntegro.

  • Se o failover automático aparentemente falhou, verifique se os bancos de dados na réplica estão sincronizados com a réplica primária anteriormente conhecida e, em seguida, faça failover para a réplica primária. Se os bancos de dados não estiverem sincronizados, selecione uma réplica com perda mínima de dados e recupere no modo de failover.

  • Se o recurso no cluster estiver offline enquanto as instâncias do SQL Server parecerem saudáveis, use o Gerenciador de Cluster de Failover para verificar a integridade do cluster ou outros problemas de cluster no servidor. Você também pode usar o Gerenciador de Cluster de Failover para tentar colocar o recurso de grupo de disponibilidade online.

  • Se houver um failover em andamento, aguarde a conclusão do failover.