Дашборды мониторинга

ℹ️ О дашбордах мониторинга

Дашборд мониторинга — это центральный экран для контроля состояния узлов сети, бизнес-сервисов и основных показателей производительности. Он обновляет данные самостоятельно. Общего выбора периода и кнопки ручного обновления на этой странице нет.

Обзор дашборда

Дашборд собирает в одном месте сводку по состоянию всей инфраструктуры. Он показывает общую картину по узлам, бизнес-сервисам, CPU, RAM, дискам, сети и контрольным событиям обслуживания.

Путь к дашборду

Откройте меню Мониторинг и перейдите в дашборд мониторинга.

Структура дашборда

Основные секции

  • Статус узлов - онлайн и офлайн узлы в виде круговой диаграммы
  • Бизнес-сервисы - таблица сервисов с автоматическим расчетом здоровья
  • Системные ресурсы - топы узлов по CPU и RAM
  • Производительность дисковой подсистемы - время отклика, IOPS, чтение, запись, заполнение
  • Сетевая активность - суммарная, входящая и исходящая скорость по интерфейсам
  • Состояние сетевого соединения - потери пакетов и время отклика по данным соответствующих виджетов
  • События мониторинга и настройки - недоступные узлы, устаревшие агенты и карточки обслуживания
✅ Автоматическое обновление

Данные обновляются без участия пользователя. Если значение кажется устаревшим, сначала дождитесь следующего обновления виджета, а затем перезагрузите страницу в браузере.

Общее состояние инфраструктуры

Статус узлов

Виджет Статус узлов показывает распределение узлов по состоянию доступности. Зеленый сектор соответствует онлайн-узлам, красный - офлайн-узлам.

Статус Цвет Описание
Онлайн ● Зеленый Узел доступен и отвечает на ping-запросы
Офлайн ● Красный Узел недоступен или не отвечает на ping

Бизнес-сервисы

Виджет Бизнес-сервисы показывает до 10 сервисов и их текущее здоровье. Здоровье определяется автоматически по открытым инцидентам на узлах, входящих в сервис.

Что видно в таблице

  • Сервис - название сервиса, по нажатию открывается модальное окно с деталями
  • Здоровье - статус сервиса, рассчитанный автоматически
💡 Пустое состояние

Если сервисы еще не созданы, виджет показывает подсказку с кнопкой Создать сервис. Это помогает быстро начать группировать связанные узлы в логические сервисы.

Мониторинг системных ресурсов

Системные ресурсы отображаются в виде топ-10 списков для узлов с установленными агентами. Виджеты показывают только свежие данные и учитывают системный параметр dashboard_metrics_max_age.

Топ-10 по загрузке ЦПУ

Показывает узлы с наибольшей загрузкой процессора в процентах.

Отображаемая информация

  • Узел - название узла
  • ЦПУ - значение с цветовой индикацией порогов

Топ-10 по загрузке ОЗУ

Показывает узлы с наибольшим использованием оперативной памяти.

Отображаемая информация

  • Узел - название узла
  • ОЗУ - значение с цветовой индикацией порогов

Цветовая индикация ресурсов

Уровень Цвет Условие
Норма ● Зеленый Значение ниже порога предупреждения
Предупреждение ● Оранжевый Значение между предупреждающим и критическим порогом
Критическое ● Красный Значение выше критического порога
⚙️ Настройка порогов

Пороги для ресурсов задаются в системных параметрах и могут быть переопределены на уровне конкретного узла или папки. При отсутствии индивидуальных настроек используются рекомендованные значения.

Производительность дисковой подсистемы

Секция доступна только для узлов с установленными агентами. Она объединяет метрики отклика, скорости передачи, IOPS, заполнения и скорости чтения/записи дисков.

⚠️ Требование агентов

Без агентов мониторинга метрики дисковой подсистемы не собираются, поэтому эта секция скрывается для неподдерживаемых узлов. В топах также не показываются устаревшие значения, которые старше настроенного лимита свежести.

Топ-10 по времени отклика диска

Показывает узлы и диски с наибольшим временем отклика.

Отображаемая информация

  • Узел - название узла
  • Диск - имя диска или раздела
  • Время отклика - задержка в миллисекундах

Топ-10 по скорости передачи с/на диск

Показывает узлы с наибольшей суммарной скоростью чтения и записи.

Отображаемая информация

  • Узел - название узла
  • Диск - имя диска
  • Скорость передачи - значение в МБ/с

Топ-10 по IOPS диска

Показывает узлы с наибольшим количеством операций ввода-вывода в секунду.

Отображаемая информация

  • Узел - название узла
  • Диск - имя диска
  • Операций/с - количество операций в секунду

Топ-10 по занятому месту на диске

Показывает узлы с наибольшим процентом заполнения дискового пространства.

Отображаемая информация

  • Узел - название узла
  • Диск - прогресс-бар с процентом заполнения

Топ-10 по скорости чтения с диска

Показывает узлы с максимальной скоростью чтения.

Отображаемая информация

  • Узел - название узла
  • Диск - имя диска
  • Скорость чтения - значение в МБ/с

Топ-10 по скорости записи на диск

Показывает узлы с максимальной скоростью записи.

Отображаемая информация

  • Узел - название узла
  • Диск - имя диска
  • Скорость записи - значение в МБ/с

Сетевая активность

Секция показывает загрузку сетевых интерфейсов в разрезе отдельных узлов и интерфейсов.

Топ-10 по скорости сети (общая)

Показывает интерфейсы с наибольшей суммарной скоростью передачи данных.

Отображаемая информация

  • Узел - название узла
  • Интерфейс - имя сетевого интерфейса
  • Скорость - суммарная скорость в Мбит/с

Топ-10 по скорости сети (прием)

Показывает интерфейсы с максимальной скоростью приема.

Отображаемая информация

  • Узел - название узла
  • Интерфейс - имя интерфейса
  • Прием - скорость приема в Мбит/с

Топ-10 по скорости сети (передача)

Показывает интерфейсы с максимальной скоростью отправки.

Отображаемая информация

  • Узел - название узла
  • Интерфейс - имя интерфейса
  • Передача - скорость отправки в Мбит/с
💡 Интерфейсы считаются отдельно

Один узел может попадать в список несколько раз, если у него несколько активных интерфейсов с высокой нагрузкой. Это удобно для точечной диагностики сети.

Состояние сетевого соединения

В этой секции собраны показатели качества связи на основе проверки доступности узлов. Период расчета задается самим виджетом и не меняется общим переключателем на странице.

Топ-10 по потере пакетов

Показывает узлы с наибольшим процентом потери пакетов за период, используемый виджетом.

Отображаемая информация

  • Узел - название узла
  • Потери пакетов - процент потерянных пакетов
Уровень потерь Цвет Значение
Норма ● Зеленый ≤ 5%
Предупреждение ● Оранжевый 5% - 20%
Критическое ● Красный > 20%

Топ-10 по времени отклика сети

Показывает узлы с наибольшим средним временем отклика ping.

Отображаемая информация

  • Узел - название узла
  • Время отклика - среднее время отклика в миллисекундах
Качество связи Цвет Время отклика
Отличное ● Зеленый ≤ 50 мс
Приемлемое ● Оранжевый 50 - 200 мс
Плохое ● Красный > 200 мс
ℹ️ Как читать данные

Разные виджеты могут использовать разные интервалы сбора и расчета. Поэтому сравнивайте значения внутри одного виджета и не ищите на странице общий переключатель периода.

События и настройки

В этой секции собраны операционные списки и карточки, которые помогают быстро найти проблемные узлы и настройки мониторинга, требующие внимания.

Недоступные узлы сети

Виджет показывает таблицу всех офлайн-узлов. Для длинных списков включается пагинация.

Отображаемая информация

  • Узел - название узла
  • Путь - расположение узла в иерархии
  • Последний отклик - время последнего успешного ping
  • Статус - бейдж Недоступен

Счетчик недоступных узлов показывается в заголовке карточки.

Узлы с устаревшими версиями агентов

Виджет показывает узлы, где установлены неактуальные версии агентов мониторинга.

Отображаемая информация

  • Узел - название узла
  • Текущая версия - дата сборки установленного агента
  • Последняя версия - дата сборки актуальной версии

Если устаревших агентов нет, показывается сообщение Все агенты актуальны.

Узлы сети с переопределенными параметрами триггеров

Карточка показывает узлы, у которых хотя бы один параметр триггера отличается от унаследованного значения. В счетчик входят настройки доступности, процессора, памяти, дисков и других поддерживаемых типов триггеров.

Что отображается

  • Название узла и путь в иерархии
  • Количество переопределений
  • Нажатие на строку сначала отбирает связанные данные в остальных виджетах дашборда
  • Отдельное действие Открыть карточку узла открывает карточку; вкладку История изменений триггеров при необходимости выберите самостоятельно

Узлы с SNMP без шаблона мониторинга

Карточка помогает найти SNMP-узлы, для которых еще не назначен шаблон мониторинга.

Что отображается

  • Узел - название узла
  • Путь - расположение узла в иерархии
  • Счетчик в заголовке показывает количество таких узлов

MikroTik без резервного копирования

Карточка показывает MikroTik-узлы, для которых не настроено резервное копирование.

Что отображается

  • Узел - название узла
  • Путь - расположение узла в иерархии
  • Счетчик в заголовке показывает количество узлов без backup

Обновление данных

На дашборде нет общего выбора периода и кнопки Обновить данные. Виджеты получают новые значения самостоятельно, каждый в соответствии со своим назначением.

ℹ️ Если данные не меняются

Проверьте, поступают ли сведения от агента или службы мониторинга и не устарели ли они. Затем перезагрузите страницу браузера. Отсутствие общей кнопки обновления не означает, что сбор данных остановлен.

Рекомендации

Эффективное использование дашборда

Регулярный мониторинг

  • Держите дашборд открытым на отдельном экране для постоянного контроля
  • Следите за красными и оранжевыми индикаторами - они требуют первоочередной проверки
  • Используйте счетчики в заголовках карточек, чтобы быстро оценивать объем проблем

Анализ трендов

  • Сравнивайте последовательные значения одного виджета, чтобы заметить устойчивые отклонения
  • Если узел стабильно попадает в топ по CPU, RAM или диску, это сигнал для масштабирования
  • Рост потерь пакетов и времени отклика за длительный период обычно указывает на сетевую проблему

Быстрая диагностика

  • Открывайте узел по клику в таблицах, чтобы перейти к детальной карточке
  • Начинайте проверку с недоступных узлов и устаревших агентов
  • Проверяйте карточки с переопределенными триггерами, если поведение узла отличается от общего шаблона

Проактивное управление

  1. Сначала устраняйте проблемы на критичных узлах и сервисах
  2. Планово обновляйте агентов и проверяйте SNMP-шаблоны
  3. Следите за узлами MikroTik без резервного копирования, чтобы не потерять конфигурацию
✅ Совет

Используйте дашборд мониторинга как стартовую точку диагностики: сначала находите проблемный узел в топах и списках обслуживания, затем переходите к его детальной карточке и графикам.