Infrastructure Monitoring

Мониторинг
ИТ-инфраструктуры

Нам доверяют крупнейшие компании России и СНГ

Контролируем серверы, Kubernetes,
базы данных, очереди, облака
и сетевые устройства на готовых дашбордах

Один агент обнаруживает все компоненты инфраструктуры, строит карту связей между ними и связывает проблемы инфраструктуры с производительностью приложений

Запросить триал
Каталог ресурсов: автодискаверинг компонентов инфраструктуры
01 · Мониторинг ИТ-инфраструктуры

Автодискаверинг всех компонентов инфраструктуры и РСМ

БольИнфраструктура меняется каждый день – сервисы, поды, виртуальные машины, очереди и базы данных появляются и исчезают. Поддерживать актуальную схему вручную невозможно, в момент аварии никто не знает что с чем связано.

ProtoАвтоматически обнаруживает все компоненты инфраструктуры и строит Ресурсно-сервисную модель с полной видимостью взаимосвязей, вложенностью объектов и проблемными элементами.

  • Анализ работы всех компонентов инфраструктуры
  • Единый каталог ресурсов с фильтрами по типу, CI-классу, окружению и статусу
  • Переход от проблемы в инфраструктуре к затронутым сервисам за один клик
Мониторинг Kubernetes: обзор кластера, карта здоровья подов и проблемные нагрузки
02 · Мониторинг Kubernetes

Углублённый анализ работы Kubernetes

БольВ кластере сотни объектов, они постоянно пересоздаются. Найти нужный под через kubectl, понять почему он рестартует и связать это с приложением — долго и неудобно.

ProtoАвтоматически инвентаризирует все объекты Kubernetes, связывает с приложениями и показывает детальную информацию о проблемах.

  • Инвентарь кластеров со счётчиками неймспейсов, нод, рабочих нагрузок и подов
  • Карточка объекта – статус и readiness, контейнеры с requests/limits, рестарты, манифест в JSON
  • Deployment, StatefulSet, DaemonSet, CronJob и Job с переходом по клику на дашборд пода, неймспейса или кластера
  • Мультикластерность – объекты автоматически попадают в ресурсно-сервисную модель
Мониторинг баз данных: обзор вызовов к БД и анализ SQL-запросов по операциям
03 · Мониторинг баз данных

Анализ SQL-запросов и производительности баз данных

БольПриложение тормозит из-за базы, но какой именно запрос виноват неизвестно. Разбирать логи и планы выполнения вручную по каждой СУБД долго, а на продакшене ещё и рискованно.

ProtoСобирает данные по каждому запросу в базу данных. Показывает здоровье самой СУБД, анализирует влияние на работу приложения и указывает узкие места.

  • Активные и ожидающие запросы, блокировки, размер и bloat базы
  • Топ SQL-запросов по частоте вызовов и времени выполнения, ошибки и просмотренные строки
  • Сэмплы планов выполнения (EXPLAIN) — видно, где не используется индекс
  • Возможность безагентного мониторинга баз данных
Мониторинг Яндекс Облака: виртуальные машины Compute Cloud
04 · Мониторинг Яндекс Облака

Готовые отчёты производительности Яндекс Облака

БольОблачные ресурсы живут в отдельной консоли, а on-premise в системе мониторинга. Собрать общую картину по гибридной инфраструктуре и понять упирается ли ВМ в квоту получается только вручную.

ProtoПоказывает на готовых дашбордах производительность Yandex Cloud с возможностью анализа остальной инфраструктуры без ручной настройки отчётов.

  • Готовые дашборды Compute Cloud – список виртуальных машин и детальный дашборд по каждой
  • Метрики CPU, дисков (IOPS, latency, ошибки), сети и утилизации квот
  • Managed Kubernetes, файловые хранилища Filestore и группы виртуальных машин
  • Собирает любые метрики Яндекс Облака
Мониторинг сети: сетевые проверки — доступность, SLA и время резолва DNS
05 · Мониторинг сети

Безагентный мониторинг сети и сетевых устройств

БольСтавить агент на коммутатор или межсетевой экран нельзя, без этого сеть остаётся слепой зоной.

ProtoСканирует подсеть по SNMP v2/v3, сам определяет модель каждого устройства и подбирает профиль сбора метрик. Синтетические проверки контролируют доступность сервисов снаружи.

  • Автоматическое сканирование подсети и определение устройства по sysObjectID
  • 200+ профилей из коробки: Cisco, Juniper, F5 BIG-IP, Fortinet FortiGate, Check Point
  • Uptime, загрузка CPU, трафик In/Out, ошибки и статус интерфейсов, отброшенные пакеты
  • Проверки HTTP, TCP, DNS, SSH, TLS и NTP — вплоть до контроля срока действия сертификата
Enterprise возможности

Все для корпоративной эксплуатации – от разграничения доступа до контроля SLO и AI-анализа инцидентов

Запросить демо
Ресурсно-сервисные модели

Автоматическое построение топологий и связей между сервисами, приложениями и инфраструктурой с индикацией проблем.

AI-диагностика инцидентов

Регистрация, маршрутизация и анализ инцидентов в реальном времени, с указанием причин проблемы и рекомендаций по устранению.

Расширенная модель RBAC

Гибкий контроль доступа к данным и функциям с разграничением по ролям, ресурсам, сервисам и командам.

Контроль SLO

Управление уровнем обслуживания и контроль error budget по ключевым сервисам и бизнес-системам.

Конструкторы дашбордов и отчётов

Кастомные дашборды, OLAP и PromQL отчёты, конструктор бизнес-процессов под любые сценарии без ограничений.

СМИ о нас

AI-мониторинг для любого стека

FAQ по мониторингу ИТ-инфраструктуры

Мониторинг ИТ-инфраструктуры — это непрерывный сбор данных о физических и виртуальных компонентах инфраструктуры организации: серверах и операционных системах, виртуальных машинах, контейнерах и Kubernetes, базах данных, очередях сообщений, облачных ресурсах и сетевых устройствах. Он позволяет в реальном времени оценивать их производительность, состояние и доступность, а в Proto Observability — ещё и связывать проблемы инфраструктуры с производительностью приложений и пользовательским опытом.

Нет. Один агент обнаруживает компоненты инфраструктуры автоматически и приносит их в ресурсно-сервисную модель вместе со связями — сервисы, поды Kubernetes, виртуальные машины, очереди, базы данных и внешние API. Дашборды по хостам, кластерам, СУБД и сетевым устройствам идут из коробки, а обнаруженные ресурсы проходят жизненный цикл Provisional → Confirmed → Stale → Retired, поэтому модель не засоряется тем, что уже удалено.

Ресурсно-сервисная модель (РСМ) — это единый реестр ИТ-ресурсов и их взаимосвязей. Она визуализирует результат автодискаверинга: каталог ресурсов с фильтрами по типу, CI-классу и окружению, граф связей и граф вложенности. Благодаря ей в момент аварии видно, какие сервисы, поды и хосты затронуты и через что проблема распространяется, — а не приходится собирать эту картину по памяти. РСМ доступна начиная с версии 200.

Да. Сетевые устройства мониторятся безагентно по SNMP v2/v3: платформа сканирует подсеть, определяет модель устройства по sysObjectID и подбирает один из 200+ встроенных профилей — Cisco, Juniper, F5 BIG-IP, Fortinet FortiGate, Check Point. Яндекс Облако опрашивается через Yandex Cloud Monitoring API, виртуализация vSphere — через API vCenter Server. Производительность СУБД можно оценивать и без агента на сервере базы — по вызовам от приложений («виртуальные» базы данных).