Вы успешно подписались на блог Naumen
Статьи доступны к чтению
Добро пожаловать! Регистрация прошла успешно.
Отлично! Ваш аккаунт активирован, контент доступен.
Success! Your billing info is updated.
Billing info update failed.
7 признаков того, что компании нужен зонтичный мониторинг

7 признаков того, что компании нужен зонтичный мониторинг

7 минут чтения

Зонтичный мониторинг нередко воспринимают как излишество. Кажется, зачем эта надстройка, если данные о состоянии объектов ИТ-инфраструктуры и так исправно поступают, например, из разных систем корневого мониторинга.

В материале рассмотрели 7 признаков, которые укажут на то, что базовый мониторинг перестает справляться и пора внедрять зонтичные решения.


Признак 1. Разрозненность корневых систем мониторинга

Распространенная ситуация: по мере развития компании разрастается ИТ-инфраструктура. Постепенно, чтобы охватить все новые сегменты, внедряются системы корневого мониторинга. Это решения, которые взаимодействуют напрямую с оборудованием и снимают нужные метрики.

С одной стороны, все под присмотром. С другой, данные остаются разрозненными. Информация в разных форматах хранится в разных системах, и с ней работают разные специалисты. Поэтому инфраструктура зачастую похожа на разобранный пазл: части есть, а общей картины нет.

Зонтичный мониторинг, например, система Naumen Business Service Monitoring (BSM), и есть тот потенциальный единый центр, который умеет собирать информацию из корневых мониторингов. Он аккумулирует, систематизирует и показывает данные в виде ресурсно-сервисной модели, которая отображает, как объекты инфраструктуры связаны между собой и как влияют на услугу.


Признак 2. Непонятна связь между оборудованием и услугами

Системы корневого мониторинга взаимодействуют с оборудованием. Но оборудование и предоставляемая услуга — разные объекты.

Рассмотрим на примере. Корневой мониторинг фиксирует, что на сервере занято 80% памяти. Ответственный за этот сервер видит только техническое событие, но не может оценить, какие бизнес-сервисы окажутся под угрозой. Чтобы понять последствия, нужно вручную пройти по цепочке: сервер — база данных — приложение — услуга. На это уходит время, а пользователи уже начинают жаловаться на сбой.

С зонтичным мониторингом связь между оборудованием и услугами зафиксирована в ресурсно-сервисной модели. Система автоматически определяет, какие сервисы пострадают от перегрузки сервера, и уведомляет ответственного за услугу, а не только за оборудование.

Кроме того, некоторые сбои можно распознать только при одновременных сигналах из разных корневых систем. Например, в Naumen BSM можно создавать триггеры, которые ориентируются на данные из разных источников. Если в комплексе показатели сигнализируют о нештатной ситуации, сбой не будет упущен. Ликвидировать его получится еще до того, как пользователи поднимут тревогу. Данные из инструментов мониторинга превращаются из разрозненных сигналов о проблемах в полезную аналитику, ведущую к проактивным действиям.


Признак 3. Нет полной картины ИТ-инфраструктуры

При классическом ИТ-мониторинге каждая команда видит только свою часть инфраструктуры, что создает слепые зоны в понимании общего состояния и взаимосвязей. Команды часто фокусируются исключительно на своих участках. Поэтому, столкнувшись с вопросами «Каково влияние отказа этого сервера на общую работоспособность?» или «Какой сервис следует восстановить в первую очередь?», они могут оказаться в затруднении.

У менеджера услуги, при отсутствии зонтичного мониторинга, нет рабочего инструмента для определения работоспособности сервиса. О сбое он, скорее всего, узнает, когда пользователи обратятся в техподдержку. И будет только один способ выяснить причину — идти к ИТ-командам, которые поддерживают нужное оборудование. Но какое оборудование нужно проверить и починить, тоже не сразу понятно, ведь услуга обеспечивается разными устройствами.

Ответственный за услугу потратит время, чтобы выяснить первопричину и понять, сколько займет восстановление. Пользователи же будут оставаться без сервиса.

В свою очередь зонтичный мониторинг получит из корневого информацию о сбое в оборудовании, поймет, какая услуга может от этого пострадать, и уведомит ответственного специалиста. В Naumen BSM можно построить ресурсно-сервисную модель, чтобы перейти от услуги к связанному оборудованию и получить более детальные данные о том, какое именно устройство пострадало.

В результате проблемы и неполадки оцениваются с точки зрения воздействия на общую стабильность и эффективность бизнеса, а не как инциденты на конкретных узлах инфраструктуры. Зонтичный мониторинг становится единым окном, где видны все взаимосвязи, зоны ответственности и статусы восстановления.


Признак 4. Инженеры тонут в потоке уведомлений

Каждая система инфраструктурного мониторинга генерирует поток уведомлений. В результате специалисты тратят время на разбор второстепенных сигналов, пропуская критичные.

В зонтичной системе дедупликация и корреляция событий позволяют снизить уровень «шума» от систем мониторинга до 90%. Фильтрация ненужных сообщений, объединение данных и расстановка приоритетов помогают командам избавиться от лишнего алертинга и приоритизировать задачи при работе над проблемами. В результате снижается количество ложных срабатываний, а также уменьшаются затраты на обработку инцидентов.


Признак 5. Нет подготовки к регламентным работам

Оборудование не может выполнять свои функции, когда на нем ведутся технические работы. Значит, услуга, которую обеспечивает это оборудование, будет временно недоступна, что ведет к недовольству пользователей. Кроме того, от корневого мониторинга пойдет поток уведомлений о том, что с устройством что-то не так.

С помощью зонтичного мониторинга влияние профилактических работ заметно смягчается. За счет ресурсно-сервисной модели сразу будет понятно, какие сервисы недоступны, пока оборудование не работает. Можно заранее оповестить пользователей, чтобы это не стало для них неприятной неожиданностью.

Чтобы избежать тревоги на сигналы от корневых мониторингов, в зонтичной системе фиксируется время регламентных работ. Когда оно настанет, здоровье нужных устройств изменится на «Профилактические работы». Когда по ним из корневого мониторинга поступит уведомление о неработоспособности, это не повлечет создания аварийных инцидентов. Система зонтичного мониторинга будет понимать — аварии нет, ведутся регламентные технические работы.


Признак 6. Восстановление после сбоев занимает много времени

Системы корневого мониторинга уведомляют не только о поломках. Они фиксируют отклонения от нормы, но эти события нередко бывают нейтральными или позитивными. В любом случае важно определить, что именно произошло. Без зонтичного мониторинга это делается вручную, поэтому процесс затягивается.

Зонтичный мониторинг автоматизирует анализ метрик. Полученные из корневого мониторинга данные он обогащает ссылками:

  • на оборудование, по которому пришло событие;
  • ситуации, по которым можно классифицировать событие;
  • услуги, которые обеспечиваются данным оборудованием.

Исходя из всей этой информации, по преднастроенным правилам система классифицирует это событие: закрыть, отложить или создать запрос.

Поиск первопричин, перебрасывание ответственности между командами, ручная координация — все это увеличивает время реакции. Зонтичный мониторинг автоматизирует процесс: система сама определяет источники проблемы, уведомляет нужных специалистов и предлагает сценарии восстановления.


Признак 7. Непонятно, как ИТ-проблемы влияют на бизнес-показатели

В классическом ИТ-мониторинге отсутствует информация о влиянии ИТ-инфраструктуры на финансовые показатели компании. У руководства нет инструментов, чтобы оценить ущерб от каждого инцидента.

Из-за этого возникают бизнес-потери: снижение выручки, повышение внутренних издержек, а также репутационные риски и дополнительные затраты на устранение инцидентов.

Зонтичный мониторинг связывает технические инциденты с услугами и регулярно обновляет дашборды с бизнес-метриками. Они помогают в режиме реального времени оценить влияние каждого сбоя на выручку и ключевые показатели эффективности. При необходимости руководитель может скорректировать план и изменить приоритеты, чтобы избежать лишних трат.


Главное

  1. Системы корневого мониторинга собирают метрики только со своих сегментов ИТ-инфраструктуры, и данные остаются разрозненными. Зонтичный мониторинг объединяет информацию из разных источников и формирует единую картину состояния ИТ-сервисов.
  2. Корневой мониторинг фиксирует технические события, но не показывает, какие бизнес-сервисы пострадают. Зонтичный мониторинг через ресурсно-сервисную модель автоматически определяет влияние сбоя на услуги и исключает дублирование инцидентов, регулируя потоки уведомлений.
  3. Система автоматически классифицирует события по преднастроенным правилам, определяет источники проблем и предлагает сценарии восстановления. Регламентные работы перестают создавать ложные аварии: система меняет статус оборудования на «Профилактические работы» и не генерирует инциденты.
  4. Зонтичный мониторинг связывает технические инциденты с бизнес-метриками, позволяя оценивать ущерб от каждого сбоя и корректировать приоритеты восстановления.

Naumen Business Service Monitoring


Агрегирование и анализ данных со всех систем мониторинга, дискаверинга, инвентаризации и учета


Наверх ↑