Дашборды мониторинга
Дашборд мониторинга — это центральный экран для контроля состояния узлов сети, бизнес-сервисов и основных показателей производительности. Он обновляет данные самостоятельно. Общего выбора периода и кнопки ручного обновления на этой странице нет.
Обзор дашборда
Дашборд собирает в одном месте сводку по состоянию всей инфраструктуры. Он показывает общую картину по узлам, бизнес-сервисам, CPU, RAM, дискам, сети и контрольным событиям обслуживания.
Путь к дашборду
Откройте меню Мониторинг и перейдите в дашборд мониторинга.
Структура дашборда
Основные секции
- Статус узлов - онлайн и офлайн узлы в виде круговой диаграммы
- Бизнес-сервисы - таблица сервисов с автоматическим расчетом здоровья
- Системные ресурсы - топы узлов по CPU и RAM
- Производительность дисковой подсистемы - время отклика, IOPS, чтение, запись, заполнение
- Сетевая активность - суммарная, входящая и исходящая скорость по интерфейсам
- Состояние сетевого соединения - потери пакетов и время отклика по данным соответствующих виджетов
- События мониторинга и настройки - недоступные узлы, устаревшие агенты и карточки обслуживания
Данные обновляются без участия пользователя. Если значение кажется устаревшим, сначала дождитесь следующего обновления виджета, а затем перезагрузите страницу в браузере.
Общее состояние инфраструктуры
Статус узлов
Виджет Статус узлов показывает распределение узлов по состоянию доступности. Зеленый сектор соответствует онлайн-узлам, красный - офлайн-узлам.
| Статус | Цвет | Описание |
|---|---|---|
| Онлайн | ● Зеленый | Узел доступен и отвечает на ping-запросы |
| Офлайн | ● Красный | Узел недоступен или не отвечает на ping |
Бизнес-сервисы
Виджет Бизнес-сервисы показывает до 10 сервисов и их текущее здоровье. Здоровье определяется автоматически по открытым инцидентам на узлах, входящих в сервис.
Что видно в таблице
- Сервис - название сервиса, по нажатию открывается модальное окно с деталями
- Здоровье - статус сервиса, рассчитанный автоматически
Если сервисы еще не созданы, виджет показывает подсказку с кнопкой Создать сервис. Это помогает быстро начать группировать связанные узлы в логические сервисы.
Мониторинг системных ресурсов
Системные ресурсы отображаются в виде топ-10 списков для узлов с установленными агентами. Виджеты показывают только свежие данные и учитывают системный параметр dashboard_metrics_max_age.
Топ-10 по загрузке ЦПУ
Показывает узлы с наибольшей загрузкой процессора в процентах.
Отображаемая информация
- Узел - название узла
- ЦПУ - значение с цветовой индикацией порогов
Топ-10 по загрузке ОЗУ
Показывает узлы с наибольшим использованием оперативной памяти.
Отображаемая информация
- Узел - название узла
- ОЗУ - значение с цветовой индикацией порогов
Цветовая индикация ресурсов
| Уровень | Цвет | Условие |
|---|---|---|
| Норма | ● Зеленый | Значение ниже порога предупреждения |
| Предупреждение | ● Оранжевый | Значение между предупреждающим и критическим порогом |
| Критическое | ● Красный | Значение выше критического порога |
Пороги для ресурсов задаются в системных параметрах и могут быть переопределены на уровне конкретного узла или папки. При отсутствии индивидуальных настроек используются рекомендованные значения.
Производительность дисковой подсистемы
Секция доступна только для узлов с установленными агентами. Она объединяет метрики отклика, скорости передачи, IOPS, заполнения и скорости чтения/записи дисков.
Без агентов мониторинга метрики дисковой подсистемы не собираются, поэтому эта секция скрывается для неподдерживаемых узлов. В топах также не показываются устаревшие значения, которые старше настроенного лимита свежести.
Топ-10 по времени отклика диска
Показывает узлы и диски с наибольшим временем отклика.
Отображаемая информация
- Узел - название узла
- Диск - имя диска или раздела
- Время отклика - задержка в миллисекундах
Топ-10 по скорости передачи с/на диск
Показывает узлы с наибольшей суммарной скоростью чтения и записи.
Отображаемая информация
- Узел - название узла
- Диск - имя диска
- Скорость передачи - значение в МБ/с
Топ-10 по IOPS диска
Показывает узлы с наибольшим количеством операций ввода-вывода в секунду.
Отображаемая информация
- Узел - название узла
- Диск - имя диска
- Операций/с - количество операций в секунду
Топ-10 по занятому месту на диске
Показывает узлы с наибольшим процентом заполнения дискового пространства.
Отображаемая информация
- Узел - название узла
- Диск - прогресс-бар с процентом заполнения
Топ-10 по скорости чтения с диска
Показывает узлы с максимальной скоростью чтения.
Отображаемая информация
- Узел - название узла
- Диск - имя диска
- Скорость чтения - значение в МБ/с
Топ-10 по скорости записи на диск
Показывает узлы с максимальной скоростью записи.
Отображаемая информация
- Узел - название узла
- Диск - имя диска
- Скорость записи - значение в МБ/с
Сетевая активность
Секция показывает загрузку сетевых интерфейсов в разрезе отдельных узлов и интерфейсов.
Топ-10 по скорости сети (общая)
Показывает интерфейсы с наибольшей суммарной скоростью передачи данных.
Отображаемая информация
- Узел - название узла
- Интерфейс - имя сетевого интерфейса
- Скорость - суммарная скорость в Мбит/с
Топ-10 по скорости сети (прием)
Показывает интерфейсы с максимальной скоростью приема.
Отображаемая информация
- Узел - название узла
- Интерфейс - имя интерфейса
- Прием - скорость приема в Мбит/с
Топ-10 по скорости сети (передача)
Показывает интерфейсы с максимальной скоростью отправки.
Отображаемая информация
- Узел - название узла
- Интерфейс - имя интерфейса
- Передача - скорость отправки в Мбит/с
Один узел может попадать в список несколько раз, если у него несколько активных интерфейсов с высокой нагрузкой. Это удобно для точечной диагностики сети.
Состояние сетевого соединения
В этой секции собраны показатели качества связи на основе проверки доступности узлов. Период расчета задается самим виджетом и не меняется общим переключателем на странице.
Топ-10 по потере пакетов
Показывает узлы с наибольшим процентом потери пакетов за период, используемый виджетом.
Отображаемая информация
- Узел - название узла
- Потери пакетов - процент потерянных пакетов
| Уровень потерь | Цвет | Значение |
|---|---|---|
| Норма | ● Зеленый | ≤ 5% |
| Предупреждение | ● Оранжевый | 5% - 20% |
| Критическое | ● Красный | > 20% |
Топ-10 по времени отклика сети
Показывает узлы с наибольшим средним временем отклика ping.
Отображаемая информация
- Узел - название узла
- Время отклика - среднее время отклика в миллисекундах
| Качество связи | Цвет | Время отклика |
|---|---|---|
| Отличное | ● Зеленый | ≤ 50 мс |
| Приемлемое | ● Оранжевый | 50 - 200 мс |
| Плохое | ● Красный | > 200 мс |
Разные виджеты могут использовать разные интервалы сбора и расчета. Поэтому сравнивайте значения внутри одного виджета и не ищите на странице общий переключатель периода.
События и настройки
В этой секции собраны операционные списки и карточки, которые помогают быстро найти проблемные узлы и настройки мониторинга, требующие внимания.
Недоступные узлы сети
Виджет показывает таблицу всех офлайн-узлов. Для длинных списков включается пагинация.
Отображаемая информация
- Узел - название узла
- Путь - расположение узла в иерархии
- Последний отклик - время последнего успешного ping
- Статус - бейдж Недоступен
Счетчик недоступных узлов показывается в заголовке карточки.
Узлы с устаревшими версиями агентов
Виджет показывает узлы, где установлены неактуальные версии агентов мониторинга.
Отображаемая информация
- Узел - название узла
- Текущая версия - дата сборки установленного агента
- Последняя версия - дата сборки актуальной версии
Если устаревших агентов нет, показывается сообщение Все агенты актуальны.
Узлы сети с переопределенными параметрами триггеров
Карточка показывает узлы, у которых хотя бы один параметр триггера отличается от унаследованного значения. В счетчик входят настройки доступности, процессора, памяти, дисков и других поддерживаемых типов триггеров.
Что отображается
- Название узла и путь в иерархии
- Количество переопределений
- Нажатие на строку сначала отбирает связанные данные в остальных виджетах дашборда
- Отдельное действие Открыть карточку узла открывает карточку; вкладку История изменений триггеров при необходимости выберите самостоятельно
Узлы с SNMP без шаблона мониторинга
Карточка помогает найти SNMP-узлы, для которых еще не назначен шаблон мониторинга.
Что отображается
- Узел - название узла
- Путь - расположение узла в иерархии
- Счетчик в заголовке показывает количество таких узлов
MikroTik без резервного копирования
Карточка показывает MikroTik-узлы, для которых не настроено резервное копирование.
Что отображается
- Узел - название узла
- Путь - расположение узла в иерархии
- Счетчик в заголовке показывает количество узлов без backup
Обновление данных
На дашборде нет общего выбора периода и кнопки Обновить данные. Виджеты получают новые значения самостоятельно, каждый в соответствии со своим назначением.
Проверьте, поступают ли сведения от агента или службы мониторинга и не устарели ли они. Затем перезагрузите страницу браузера. Отсутствие общей кнопки обновления не означает, что сбор данных остановлен.
Рекомендации
Эффективное использование дашборда
Регулярный мониторинг
- Держите дашборд открытым на отдельном экране для постоянного контроля
- Следите за красными и оранжевыми индикаторами - они требуют первоочередной проверки
- Используйте счетчики в заголовках карточек, чтобы быстро оценивать объем проблем
Анализ трендов
- Сравнивайте последовательные значения одного виджета, чтобы заметить устойчивые отклонения
- Если узел стабильно попадает в топ по CPU, RAM или диску, это сигнал для масштабирования
- Рост потерь пакетов и времени отклика за длительный период обычно указывает на сетевую проблему
Быстрая диагностика
- Открывайте узел по клику в таблицах, чтобы перейти к детальной карточке
- Начинайте проверку с недоступных узлов и устаревших агентов
- Проверяйте карточки с переопределенными триггерами, если поведение узла отличается от общего шаблона
Проактивное управление
- Сначала устраняйте проблемы на критичных узлах и сервисах
- Планово обновляйте агентов и проверяйте SNMP-шаблоны
- Следите за узлами MikroTik без резервного копирования, чтобы не потерять конфигурацию
Используйте дашборд мониторинга как стартовую точку диагностики: сначала находите проблемный узел в топах и списках обслуживания, затем переходите к его детальной карточке и графикам.