Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Questa guida ti aiuta a iniziare a monitorare i gruppi di disponibilità e a risolvere alcuni dei problemi comuni nei gruppi di disponibilità. Fornisce contenuti originali e una pagina di destinazione con informazioni utili che vengono pubblicate altrove. Sebbene questa guida non possa discutere completamente tutti i problemi che possono verificarsi nell'ampia area dei gruppi di disponibilità, può indirizzarti nella giusta direzione nell'analisi delle cause radici e nella risoluzione dei problemi.
Poiché i gruppi di disponibilità sono una tecnologia integrata, molti dei problemi che incontri possono essere sintomi di altri problemi nel tuo sistema di database. Alcuni problemi sono causati da impostazioni all'interno di un gruppo di disponibilità, come la sospensione di un database di disponibilità. Altri problemi possono includere problemi con altri aspetti di SQL Server, come le impostazioni di SQL Server, la distribuzione dei file di database e problemi sistemici di prestazioni non correlati alla disponibilità. Altri problemi possono esistere al di fuori di SQL Server, come problemi di I/O di rete, TCP/IP, Active Directory e Windows Server Failover Clustering (WSFC). Spesso, i problemi che emergono in un gruppo di disponibilità, replica o database richiedono di risolvere più tecnologie per identificarne la causa principale.
Scenari di risoluzione dei problemi
La tabella seguente contiene i link agli scenari comuni di troubleshooting per i gruppi di disponibilità. Sono classificati in base ai tipi di scenario, come configurazione, connettività del client, failover e prestazioni.
| Scenario | Tipo di scenario | Description |
|---|---|---|
| Risoluzione dei problemi della configurazione dei gruppi di disponibilità sempre attivi (SQL Server) | Configurazione | Fornisce informazioni per aiutarti a risolvere problemi tipici nella configurazione delle istanze server per i gruppi di disponibilità. I problemi di configurazione tipici includono: - i gruppi di disponibilità sono disabilitati - gli account sono configurati in modo errato - l'endpoint di mirroring del database non esiste - l'endpoint è inaccessibile (SQL Server Errore 1418) - l'accesso alla rete non esiste - fallimento di un comando di join database (errore di SQL Server 35250) |
| Risoluzione di un'operazione di add-file fallita (Gruppi di disponibilità sempre attivi) | Configurazione | Un'operazione di aggiunta di file ha causato la sospensione del database secondario e lo stato NON SINCRONIZZANTE. |
| Non è possibile connettersi a un ascoltatore di gruppo di disponibilità in un ambiente multi-subnet | Connettività del client | Dopo aver configurato l'ascoltatore del gruppo di disponibilità, non puoi più pingare l'ascoltatore né connetterti ad esso da un'applicazione. |
| Risoluzione dei problemi dei failover automatici falliti | Failover | Un failover automatico non si è completato con successo. |
| Risoluzione dei problemi: Il gruppo di disponibilità ha superato la soglia RTO | Performance | Dopo un failover automatico o un failover manuale pianificato senza perdita di dati, il tempo di failover supera l'RTO previsto. Oppure, quando si stima il tempo di failover di una replica secondaria con commit asincrono (ad esempio un partner di failover automatico), si scopre che supera l'obiettivo RTO. |
| Risoluzione dei problemi: Il gruppo di disponibilità ha superato la soglia RPO | Performance | Dopo aver eseguito un failover manuale forzato, la perdita di dati supera l'obiettivo definito dal tuo RPO. In alternativa, quando si calcola la potenziale perdita di dati di una replica secondaria con commit asincrono, si constata che supera il tuo Recovery Point Objective (RPO). |
| Risoluzione dei problemi: Le modifiche nella replica primaria non vengono riflesse nella replica secondaria | Performance | L'applicazione client completa correttamente un aggiornamento nella replica primaria, ma l'esecuzione di query sulla replica secondaria indica che la modifica non viene riflessa. |
| Risoluzione problemi: tipo di attesa HADR_SYNC_COMMIT alta con gruppi di disponibilità sempre attivi | Performance | Se HADR_SYNC_COMMIT è insolitamente lungo, si presenta un problema di prestazioni nel flusso di movimento dei dati o nel rendere del log di replica secondaria. |
Strumenti utili per la risoluzione dei problemi
Quando configuri o gestisci gruppi di disponibilità, diversi strumenti possono aiutarti a diagnosticare diversi tipi di problemi. La tabella seguente fornisce link a informazioni utili sugli strumenti.
| Tool | Description |
|---|---|
| Usare il dashboard Always On (SQL Server Management Studio) | Riporta una panoramica rapida dello stato del tuo gruppo di disponibilità in un'interfaccia intuitiva. |
| Politiche Always On | Utilizzato dalla dashboard Always On. |
| Log errori di SQL Server (Gruppi di disponibilità sempre attivi) | I log verificano gli eventi di transizione di stato per gruppi di disponibilità, repliche e database, gli stati di altri componenti Always On e gli errori Always On. |
| CLUSTER. LOG (Gruppi di Disponibilità Sempre Attivi) | Log, eventi del cluster, incluse le transizioni di stato della risorsa del gruppo di disponibilità, così come eventi ed errori provenienti dalla DLL di risorse di SQL Server. |
| Registro diagnostico sanitario Always On | I log SQL Server diagnostica della salute come riportati al cluster WSFC (SQL Server resource DLL) da sp_server_diagnostics (Transact-SQL). |
| Viste di gestione dinamiche e viste del catalogo di sistema (Gruppi di disponibilità sempre attivi) | Riporta informazioni sui gruppi di disponibilità come configurazione, stato di salute e metriche di prestazione. |
| Eventi estesi Always On | Fornisce diagnostiche dettagliate dei gruppi di disponibilità ed è utile per l'analisi delle cause radice. |
| Tipi sempre attivi in attesa | Fornisce statistiche di attesa specifiche per i gruppi di disponibilità ed è utile per la regolazione delle prestazioni. |
| Contatori di prestazioni Always On | L'attività dei gruppi di disponibilità del monitor è riflessa in System Monitor ed è utile per la regolazione delle prestazioni. Per ulteriori informazioni, vedi SQL Server, oggetto Availability Replica e SQL Server, oggetto Database Replica. |
| Buffer ad anello sempre attivi | Registra gli avvisi all'interno del sistema SQL Server per la diagnostica interna e può essere utilizzato per debug di problemi legati ai gruppi di disponibilità. |
Gruppi di disponibilità dei monitor
Il momento ideale per risolvere i problemi di un gruppo di disponibilità è prima che un problema richieda un failover, sia automatico che manuale. Questo può essere fatto monitorando le metriche di performance del gruppo di disponibilità e inviando avvisi quando le repliche di disponibilità stanno funzionando al di fuori dei limiti del tuo accordo di livello di servizio (SLA). Ad esempio, se una replica secondaria sincrona ha problemi di prestazioni che fanno aumentare il tempo di failover stimato, non vuoi aspettare che avvenga un failover automatico e scopri che il tempo di failover supera il tuo obiettivo di tempo di recupero.
Poiché i gruppi di disponibilità sono soluzioni ad alta disponibilità e disaster recovery, le metriche di performance più importanti da monitorare sono il tempo di failover stimato, che influisce sul tuo obiettivo di tempo di recupero (RTO), e la potenziale perdita di dati in caso di disastro, che influisce sull'obiettivo del punto di recupero (RPO). Puoi raccogliere queste metriche dai dati che SQL Server espone in qualsiasi momento, così da essere avvisati di un problema nelle capacità di alta disponibilità e disaster recovery (HADR) del tuo sistema prima che si verifichino eventi di guasto effettivi. Pertanto, è importante familiarizzare con il processo di sincronizzazione dei dati dei gruppi di disponibilità e raccogliere le metriche di conseguenza.
La tabella qui sotto ti indirizza ad articoli che possono aiutarti a monitorare la salute della soluzione dei tuoi gruppi di disponibilità.
| Articolo | Description |
|---|---|
| Monitorare le prestazioni per i gruppi di disponibilità sempre attivi | Descrive il processo di sincronizzazione dei dati per i gruppi di disponibilità, i gate di controllo del flusso e le metriche utili nel monitoraggio di un gruppo di disponibilità; e mostra anche come raccogliere metriche RTO e RPO. |
| Monitoraggio dei gruppi di disponibilità (SQL Server) | Fornisce informazioni sugli strumenti per monitorare un gruppo di disponibilità. |
| Il modello di salute Always On, parte 1: Architettura del modello di salute | Fornisce una panoramica del modello di salute Always On. |
| Il modello di salute Always On, parte 2: Estendere il modello di salute | Mostra come personalizzare il modello di salute Always On e personalizzare la Dashboard Always On per mostrare informazioni extra. |
| Monitoraggio della salute sempre attiva con PowerShell, parte 1: Panoramica base del cmdlet | Fornisce una panoramica di base dei cmdlet Always On PowerShell che possono essere utilizzati per monitorare lo stato di salute di un gruppo di disponibilità. |
| Monitoraggio della salute sempre attiva con PowerShell, parte 2: Utilizzo avanzato di cmdlet | Fornisce informazioni sull'uso avanzato dei cmdlet PowerShell Always On per monitorare lo stato di salute di un gruppo di disponibilità. |
| Monitoraggio della salute sempre attiva con PowerShell, parte 3: Una semplice applicazione di monitoraggio | Mostra come monitorare automaticamente un gruppo di disponibilità con un'applicazione. |
| Monitoraggio della salute sempre attiva con PowerShell, parte 4: Integrazione con SQL Server Agent | Fornisce informazioni su come integrare il monitoraggio dei gruppi di disponibilità con SQL Server Agent e configurare le notifiche alle parti competenti quando sorgono problemi. |