Integritätsstatusüberwachung für Hochverfügbarkeit bei Azure Database for PostgreSQL – flexibler Server

Azure Database for PostgreSQL Flexible Server enthält eine Funktion zur Überwachung des Integritätsstatus für Hochverfügbarkeit (HA), die das Resource Health Check (RHC)-Framework von Azure verwendet. Dieser Dienst bietet kontinuierliche Einblicke in die Integrität von HA-fähigen Instanzen und benachrichtigt Sie über Ereignisse, die sich auf Konnektivität und Verfügbarkeit auswirken können. In den folgenden Abschnitten werden die einzelnen Status und die zugehörigen Szenarien beschrieben, um Sie bei der Problembehandlung zu unterstützen und die HA-Stabilität aufrechtzuerhalten.

Integritätszustände

Der Dienst überwacht jeden HA-Zustand über verschiedene interne Signale, die bestimmte Bedingungen darstellen. In der folgenden Liste werden die möglichen HA-Zustände zusammen mit visuellen Indikatoren und Szenarien beschrieben, die sich auf ihren Azure Database for PostgreSQL flexiblen Server auswirken können.

Ready – HA ist gesund

Der Status "Bereit" gibt an, dass ihr HA-fähiger Server normalerweise ohne erkannte Probleme funktioniert, die sich auf die Failoverbereitschaft auswirken. Alle erforderlichen Konfigurationen sind intakt, und es sind keine signifikanten Fehlerbedingungen vorhanden.

Screenshot der Anzeige des HA Ready-Status.

Beeinträchtigt – Netzwerksicherheitsgruppe (NSG) oder virtuelle Appliance blockiert Verbindungen

Der Status "Herabgestuft" kann angezeigt werden, wenn NSG-Regeln oder eine virtuelle Appliance wichtige Verbindungen blockieren, die für hohe Verfügbarkeit erforderlich sind. Dieses Konfigurationsproblem verhindert die vollständige HA-Funktionalität. Beheben Sie das Problem, indem Sie die NSG-Einstellungen anpassen.

Screenshot der Darstellung des Status „HA Beeinträchtigt“ aufgrund von blockierten NSG-Verbindungen.

Herabgestuft – Schreibgeschützter Zustand

Wenn Ihr flexibler PostgreSQL-Server in einen schreibgeschützten Zustand wechselt, spiegelt der Degraded-Status diese Einschränkung wider. Dieser Zustand erfordert in der Regel die Bereitstellung zusätzlicher Ressourcen oder die Behandlung der Bedingungen, die zu der schreibgeschützten Einstellung geführt haben, um die vollständige Funktionalität wiederherzustellen.

Screenshot der Anzeige des Status „HA Beeinträchtigt“ aufgrund des schreibgeschützten Zustands.

Degradiert – Hohe Verfügbarkeit im degradierten Zustand

Dieser Status wird angezeigt, wenn die Leistung des Hochverfügbarkeitsdiensts beeinträchtigt wird, möglicherweise aufgrund vorübergehender Probleme oder Bedingungen auf Systemebene. Die Implementierung der Wiederholungslogik kann dazu beitragen, die Auswirkungen dieser temporären Verbindungsunterbrechungen zu verringern. Der herabgestufte Status bedeutet nicht, dass der Server nicht verfügbar ist. Stattdessen weist dies darauf hin, dass die gesamte HA-Konfiguration und die Zustandsprüfungen noch nicht vollständig abgeschlossen sind. Trotz dieses Status kann der Server weiterhin betriebsbereit und zugänglich sein.

Verwenden Sie die is_db_alive Metrik als Teil der Datenbankverfügbarkeitsmetriken, um die Verfügbarkeit Ihrer Datenbank während dieser Zeiträume genau zu überwachen. Diese Metrik bietet einen zuverlässigen Indikator für die Verfügbarkeit der Datenbank und hilft Ihnen dabei, zwischen einer temporären unvollständigen HA-Einrichtung und tatsächlichen Ausfallzeiten zu unterscheiden.

Screenshot der Anzeige des Status „HA Beeinträchtigt“ aufgrund von Leistungsproblemen.

Herabgestuft – Geplantes Failover initiiert

Während eines geplanten Failoverereignisses, das für Ihren Server initiiert wurde, wird der Status Beeinträchtigt angezeigt und, dass HA-Failoverprozesse aktiv sind. Dieser Vorgang ist im Allgemeinen kurz und kontrolliert, und der Dienst sollte in Kürze fortgesetzt werden.

Screenshot der Anzeige des Status „HA Beeinträchtigt“ aufgrund eines geplanten Failovers.

Herabgestuft – Nicht geplantes Failover initiiert

Bei einem ungeplanten Failover gibt dieser Status ein aktives Failoverereignis an, das durch unerwartete Umstände ausgelöst wird. Dieses Szenario kann kurze Verbindungsunterbrechungen umfassen, bis der Server Failoverprozeduren abgeschlossen hat.

Screenshot der Darstellung des Status „HA Beeinträchtigt“ aufgrund eines ungeplanten Failovers.

Herabgestuft – Upgradefailover initiiert

Während der Systemupgrades wird Ihr HA-Server möglicherweise einem Upgradefailover unterzogen, um erforderliche Updates anzuwenden. In diesem Zustand schränkt der Server möglicherweise vorübergehend neue Verbindungen ein. Implementieren Sie Wiederholungslogik, um vorübergehende Probleme effektiv zu behandeln.

Screenshot der Darstellung des Status „HA Beeinträchtigt“ aufgrund eines Upgradefailovers.

Konfigurieren von Resource Health-Warnungen

Richten Sie Resource Health Warnungen ein, um Echtzeitbenachrichtigungen zu erhalten, wenn Änderungen im Integritätsstatus Ihrer HA-fähigen PostgreSQL-Instanz auftreten. Sie können diese Warnungen über das Azure-Portal oder mithilfe einer ARM-Vorlage konfigurieren. Auf diese Weise bleiben Sie über HA-Statusupdates informiert, ohne das Portal aktiv zu überwachen.

Schritte zum Konfigurieren von Warnungen zur Ressourcenintegrität über das Portal

  1. Wechseln Sie zum Azure Portal, und wählen Sie Ihren flexiblen PostgreSQL-Server aus.
  2. Wählen Sie im linken Menü unter dem Abschnitt "Überwachung" die Option "Warnungen" aus.
  3. Wählen Sie "Neue Warnungsregel" aus, und konfigurieren Sie die Warnungslogik basierend auf Resource Health Signalen.
  4. Richten Sie die Aktionsgruppe ein, um anzugeben, wie Sie benachrichtigt werden möchten (E-Mail, SMS usw.).
  5. Überprüfen Sie und richten Sie die Alarmregel ein.

Schritte zum Erstellen von Ressourcenintegritätswarnungen mithilfe der ARM-Vorlage

  1. Laden Sie die ARM-Vorlage aus dem ARM-Vorlagenhandbuch für Resource Health-Warnungen herunter.
  2. Passen Sie die Vorlage mit Ihren spezifischen Serverdetails und Benachrichtigungseinstellungen an.
  3. Stellen Sie die ARM-Vorlage mithilfe von Azure CLI oder Azure PowerShell bereit.
  4. Überprüfen Sie die Bereitstellung und stellen Sie sicher, dass die Warnungen aktiv sind.

Weitere Informationen zum Einrichten von Warnungen finden Sie in den folgenden Leitfäden:

Mithilfe von HA Health Status Monitoring erhalten Sie wichtige Einblicke in die HA-Leistung Ihres PostgreSQL-Servers und ermöglichen einen proaktiven Ansatz zur Verwaltung von Betriebszeit und Verfügbarkeit.