Если вы настроили мониторинг внутри каждой виртуалки — это хорошая привычка, но она не спасёт, когда откажет сам гипервизор. Своп на хосте, забитое общее хранилище или потерянный кворум кластера роняют не одну VM, а сразу все — и обычный агентский мониторинг гостевых систем этого просто не увидит, потому что смотрит изнутри, а не на физический хост целиком. Разберём, какие метрики специфичны именно для уровня гипервизора и почему их нужно собирать отдельно.
Подробнее →