Зонтичный мониторинг нередко воспринимают как излишество. Кажется, зачем эта надстройка, если данные о состоянии объектов
В материале рассмотрели 7 признаков, которые укажут на то, что базовый мониторинг перестает справляться и пора внедрять зонтичные решения.
Содержание
Признак 1. Разрозненность корневых систем мониторинга
Признак 2. Непонятна связь между оборудованием и услугами
Признак 3. Нет полной картины
Признак 4. Инженеры тонут в потоке уведомлений
Признак 5. Нет подготовки к регламентным работам
Признак 6. Восстановление после сбоев занимает много времени
Признак 7. Непонятно, как
Главное
Признак 1. Разрозненность корневых систем мониторинга
Распространенная ситуация: по мере развития компании разрастается
С одной стороны, все под присмотром. С другой, данные остаются разрозненными. Информация в разных форматах хранится в разных системах, и с ней работают разные специалисты. Поэтому инфраструктура зачастую похожа на разобранный пазл: части есть, а общей картины нет.
Зонтичный мониторинг, например, система Naumen Business Service Monitoring (BSM), и есть тот потенциальный единый центр, который умеет собирать информацию из корневых мониторингов. Он аккумулирует, систематизирует и показывает данные в виде

Системы корневого мониторинга нуждаются в консолидации данных и централизованном управлении
Признак 2. Непонятна связь между оборудованием и услугами
Системы корневого мониторинга взаимодействуют с оборудованием. Но оборудование и предоставляемая услуга — разные объекты.
Рассмотрим на примере. Корневой мониторинг фиксирует, что на сервере занято 80% памяти. Ответственный за этот сервер видит только техническое событие, но не может оценить, какие
С зонтичным мониторингом связь между оборудованием и услугами зафиксирована в
Кроме того, некоторые сбои можно распознать только при одновременных сигналах из разных корневых систем. Например, в Naumen BSM можно создавать триггеры, которые ориентируются на данные из разных источников. Если в комплексе показатели сигнализируют о нештатной ситуации, сбой не будет упущен. Ликвидировать его получится еще до того, как пользователи поднимут тревогу. Данные из инструментов мониторинга превращаются из разрозненных сигналов о проблемах в полезную аналитику, ведущую к проактивным действиям.

Данные корневого мониторинга не связаны с услугой «База данных», поэтому причина сбоя неочевидна
Признак 3. Нет полной картины ИТ-инфраструктуры
При классическом
У менеджера услуги, при отсутствии зонтичного мониторинга, нет рабочего инструмента для определения работоспособности сервиса. О сбое он, скорее всего, узнает, когда пользователи обратятся в техподдержку. И будет только один способ выяснить причину — идти к
Ответственный за услугу потратит время, чтобы выяснить первопричину и понять, сколько займет восстановление. Пользователи же будут оставаться без сервиса.
В свою очередь зонтичный мониторинг получит из корневого информацию о сбое в оборудовании, поймет, какая услуга может от этого пострадать, и уведомит ответственного специалиста. В Naumen BSM можно построить
В результате проблемы и неполадки оцениваются с точки зрения воздействия на общую стабильность и эффективность бизнеса, а не как инциденты на конкретных узлах инфраструктуры. Зонтичный мониторинг становится единым окном, где видны все взаимосвязи, зоны ответственности и статусы восстановления.

Cостояние услуги в системе зонтичного мониторинга показано цветом: красный — недоступна, зеленый — доступна, желтый — работоспособность услуги под угрозой
Признак 4. Инженеры тонут в потоке уведомлений
Каждая система инфраструктурного мониторинга генерирует поток уведомлений. В результате специалисты тратят время на разбор второстепенных сигналов, пропуская критичные.
В зонтичной системе дедупликация и корреляция событий позволяют снизить уровень «шума» от систем мониторинга до 90%. Фильтрация ненужных сообщений, объединение данных и расстановка приоритетов помогают командам избавиться от лишнего алертинга и приоритизировать задачи при работе над проблемами. В результате снижается количество ложных срабатываний, а также уменьшаются затраты на обработку инцидентов.

Naumen BSM анализирует события, создавая инцидент только для первого, а все связанные группирует вокруг него. Это исключает дублирование и информационный шум
Признак 5. Нет подготовки к регламентным работам
Оборудование не может выполнять свои функции, когда на нем ведутся технические работы. Значит, услуга, которую обеспечивает это оборудование, будет временно недоступна, что ведет к недовольству пользователей. Кроме того, от корневого мониторинга пойдет поток уведомлений о том, что с устройством
С помощью зонтичного мониторинга влияние профилактических работ заметно смягчается. За счет
Чтобы избежать тревоги на сигналы от корневых мониторингов, в зонтичной системе фиксируется время регламентных работ. Когда оно настанет, здоровье нужных устройств изменится на «Профилактические работы». Когда по ним из корневого мониторинга поступит уведомление о неработоспособности, это не повлечет создания аварийных инцидентов. Система зонтичного мониторинга будет понимать — аварии нет, ведутся регламентные технические работы.

Оператор не будет получать уведомлений о неработоспособности оборудования, если запланированы регламентные работы
Признак 6. Восстановление после сбоев занимает много времени
Системы корневого мониторинга уведомляют не только о поломках. Они фиксируют отклонения от нормы, но эти события нередко бывают нейтральными или позитивными. В любом случае важно определить, что именно произошло. Без зонтичного мониторинга это делается вручную, поэтому процесс затягивается.
Зонтичный мониторинг автоматизирует анализ метрик. Полученные из корневого мониторинга данные он обогащает ссылками:
- на оборудование, по которому пришло событие;
- ситуации, по которым можно классифицировать событие;
- услуги, которые обеспечиваются данным оборудованием.
Исходя из всей этой информации, по преднастроенным правилам система классифицирует это событие: закрыть, отложить или создать запрос.
Поиск первопричин, перебрасывание ответственности между командами, ручная координация — все это увеличивает время реакции. Зонтичный мониторинг автоматизирует процесс: система сама определяет источники проблемы, уведомляет нужных специалистов и предлагает сценарии восстановления.

Naumen BSM анализирует метрики и отправляет данные службе поддержки для предотвращения реального сбоя
Признак 7. Непонятно, как ИТ-проблемы влияют на бизнес-показатели
В классическом
Зонтичный мониторинг связывает технические инциденты с услугами и регулярно обновляет дашборды с

Дашборд помогает понять, где узкое место ИТ-инфраструктуры. В данном случае это эксплуатация сети
Главное
- Системы корневого мониторинга собирают метрики только со своих сегментов
ИТ-инфраструктуры , и данные остаются разрозненными. Зонтичный мониторинг объединяет информацию из разных источников и формирует единую картину состоянияИТ-сервисов . - Корневой мониторинг фиксирует технические события, но не показывает, какие
бизнес-сервисы пострадают. Зонтичный мониторинг через ресурсно-сервисную модель автоматически определяет влияние сбоя на услуги и исключает дублирование инцидентов, регулируя потоки уведомлений. - Система автоматически классифицирует события по преднастроенным правилам, определяет источники проблем и предлагает сценарии восстановления. Регламентные работы перестают создавать ложные аварии: система меняет статус оборудования на «Профилактические работы» и не генерирует инциденты.
- Зонтичный мониторинг связывает технические инциденты с
бизнес-метриками , позволяя оценивать ущерб от каждого сбоя и корректировать приоритеты восстановления.