PDF

Offline Monitoring Mode für Probes

Eine Monitoring-Probe kann die Überwachung fortsetzen, während sie vom NetCrunch Server getrennt ist, die Ergebnisse lokal zwischenspeichern und synchronisieren, sobald die Verbindung wiederhergestellt ist.

Atlas SettingsSitesMonitoring

Wenn eine Probe ihre Verbindung zum NetCrunch Server verliert, ermöglicht der Offline Monitoring Mode, dass sie selbstständig weiterarbeitet. Die Probe fragt ihre Knoten weiterhin ab und verarbeitet Trigger weiter; die Ergebnisse werden auf dem Rechner der Probe zwischengespeichert.

Sobald die Verbindung wiederhergestellt ist, synchronisiert die Probe die zwischengespeicherten Daten und kehrt zur normalen Echtzeitkommunikation zurück. Die Kontinuität der Überwachung bleibt während des Ausfalls erhalten.

Dadurch wird die Überwachung an Standorten mit instabiler oder unterbrochener Verbindung ausfallsicher. Ohne diese Funktion würde eine einstündige Unterbrechung der Verbindung eine Lücke in den Daten hinterlassen.

Offline Monitoring Mode ist eine Eigenschaft des Standorts, nicht einer einzelnen Probe. Es kann nicht auf einem Standort verwendet werden, für den Load Balancing aktiviert ist, da in diesem Modus Knoten nicht dauerhaft einer bestimmten Probe zugewiesen sind. Siehe @distributed-monitoring.

Offline Monitoring aktivieren

Offline Monitoring wird in den Überwachungseigenschaften eines Netzwerkstandorts aktiviert. Dort legen Sie auch fest, wie lange die Probe Daten sammeln darf, während sie getrennt ist. Der Standardwert beträgt 24 Stunden.

Das Limit schützt den Rechner der Probe davor, dass sich die Festplatte während eines längeren Ausfalls füllt. Wenn das Limit erreicht ist, beendet die Probe die Zwischenspeicherung neuer Ergebnisse.

offline-trends

Trends

Alle Trenddaten, die während der Offline-Zeit der Probe gesammelt wurden, werden synchronisiert, nachdem die Probe die Verbindung zum Server wiederhergestellt hat. Trends bleiben über den Ausfall hinweg vollständig erhalten — der Zeitraum, in dem die Probe getrennt war, geht nicht verloren.

offline-alerts

Alarme

Wie eine Alarmaktion ausgeführt wird, hängt davon ab, ob die Probe zu dem Zeitpunkt, an dem der Alarm geöffnet und geschlossen wurde, online war.

Alarm im Online-Zustand geöffnet
Die Alarmaktion wird normal ausgeführt. Wenn der Alarm später geschlossen wird, während die Probe offline ist, wird die Schließaktion ausgeführt, sobald die Verbindung zum Server wiederhergestellt ist.
Alarm im Offline-Zustand geöffnet und geschlossen
Es werden keine Alarmaktionen ausgeführt. Der Grund wird im Protokoll der Alarmaktionen aufgezeichnet.
Alarm im Offline-Zustand geöffnet
Die Alarmaktion wird ausgeführt, nachdem die Verbindung zum Server wiederhergestellt ist.

offline-exceptions

Was nicht aufgezeichnet wird

Einige Ereignisse werden für den Zeitraum, in dem die Probe offline war, nicht generiert, selbst wenn die zugrunde liegende Bedingung während dieser Zeit tatsächlich eingetreten ist.

  • Node Up/Down alerts
  • Network Service Up/Down alerts
  • Threshold alerts defined on Network Service counters — alle anderen Threshold alerts werden im Alarmverlauf aufgezeichnet
  • Bandwidth Sensor trends
  • Conditional alerts
  • Receivers (Syslog, SNMP Trap, Web Messages) — Nachrichten werden nicht erfasst, während die Probe offline ist. Nur für diese Receiver definierte Alarme werden im Alarmverlauf aufgezeichnet.
  • Configuration sensors (Device Config, Windows Configuration und ähnliche) — diese werden nicht ausgeführt, während die Probe offline ist, und nach der Wiederherstellung der Verbindung erneut ausgeführt.

Berücksichtigen Sie diese Liste bei der Planung, wenn ein Standort voraussichtlich längere Zeit getrennt sein wird. Die Verfügbarkeitsberichte für diesen Standort berücksichtigen das Offline-Zeitfenster nicht, da Node Up/Down events zu den Ereignissen gehören, die nicht generiert werden.

Konfigurationsänderungen während eines Ausfalls

Knoten, Sensoren und Dienste können auf dem Server hinzugefügt oder entfernt werden, während die Probe offline ist. Die Probe übernimmt diese Änderungen, sobald sie die Verbindung wiederherstellt, und wendet sie an, bevor sie den normalen Betrieb fortsetzt.

bufferingdisconnecteddistributedmonitoring probeofflineoffline monitoringproberesiliencesite