PDF

Czujnik Zdrowia Sprzętu (SNMP)

Monitoruje fizyczne czujniki sprzętu za pomocą SNMP, w tym temperaturę, prędkości wentylatorów, status zasilania i poziomy napięcia. Umożliwia proaktywne wykrywanie problemów sprzętowych i wspiera długoterminowe śledzenie trendów zdrowia systemu.

Przegląd

Czujnik Zdrowia Sprzętu (SNMP) odczytuje dane z fizycznych komponentów monitorujących udostępnionych przez ENTITY-SENSOR-MIB. Zapewnia widoczność w czasie rzeczywistym wydajności i niezawodności sprzętu, umożliwiając administratorom identyfikację problemów, takich jak przegrzewanie, awaria wentylatora czy niestabilne warunki zasilania, zanim doprowadzą do przestoju systemu.

Ten czujnik jest szczególnie przydatny do monitorowania serwerów, przełączników i innych urządzeń sieciowych wyposażonych w wbudowane czujniki środowiskowe.

Wymagania
  • Monitorowane urządzenie musi implementować ENTITY-SENSOR-MIB.
  • Na urządzeniu musi być włączone SNMP.
  • Wymagane są prawidłowe dane uwierzytelniające SNMP (ciąg społeczności lub dane uwierzytelniające SNMPv3).
Opcje
  • Dane uwierzytelniające SNMP — określ prawidłowy profil SNMP (v1, v2c lub v3) dla urządzenia.
  • Interwał odpytywania — definiuje, jak często zbierane są dane czujnika (domyślnie zgodnie z profilem urządzenia).
Zbierane metryki

Czujnik automatycznie pobiera wszystkie dostępne odczyty sprzętu udostępnione przez SNMP, w tym:

  • Czujniki temperatury (np. CPU, obudowa, zasilacz)
  • Prędkości wentylatorów (RPM)
  • Poziomy napięcia
  • Status i zdrowie zasilacza
  • Inne odczyty środowiskowe zdefiniowane przez ENTITY-SENSOR-MIB

Zebrane wartości są automatycznie klasyfikowane i wyświetlane w podsumowaniu zdrowia sprzętu, umożliwiając szybką identyfikację nieprawidłowych warunków.

Alerty

Domyślnie czujnik generuje alerty, gdy:

  • Jakikolwiek monitorowany komponent sprzętu zgłasza awarię lub krytyczny status.
  • Mierzone wartości przekraczają progi zdefiniowane w MIB urządzenia lub w niestandardowych regułach alertów.

Administratorzy mogą dostosować warunki alertów, ich poziom ważności i działania odpowiedzi w oparciu o potrzeby operacyjne.

Raporty i dane trendów

Wszystkie zebrane wartości są przechowywane w bazie danych trendów, co pozwala na długoterminową wizualizację i raportowanie za pomocą Trend Viewer.

Raporty obejmują:

  • Trendy temperatury dla każdego komponentu
  • Zmiany prędkości wentylatorów
  • Raporty o stabilności zasilania i napięcia
  • Statystyki dostępności i awarii czujników

Te informacje pomagają wykrywać stopniową degradację i przewidywać potencjalne awarie sprzętu.

Przypadki użycia
  • Monitorowanie sprzętu w serwerowni w poszukiwaniu wczesnych oznak przegrzewania.
  • Śledzenie degradacji wentylatorów w obudowach typu blade lub przełącznikach sieciowych.
  • Zapewnienie ciągłego dostarczania zasilania i stabilności napięcia w routerach i urządzeniach UPS.
  • Ustalanie bazowych warunków środowiskowych dla predykcyjnej konserwacji.
Powiązane
  • Cisco Hardware Health (SNMP) — pakiet monitorujący dla urządzeń Cisco
  • Generic UPS (SNMP) — pakiet monitorujący dla jednostek zasilania awaryjnego

environmenthardwarehealthpowersnmptemperature