Интерфейс Proto Observability Platform
Общее устройство интерфейса
Интерфейс состоит из двух постоянных элементов:
- Боковое меню слева — список разделов платформы. Меню свёрнуто до иконок и разворачивается при наведении курсора. Разделы, недоступные пользователю по правам доступа (RBAC), в меню не показываются.
- Верхняя панель — хлебные крошки текущего расположения, выбор периода наблюдения, кнопка обновления данных (с режимом автообновления), ссылка на документацию, переключатель темы оформления (светлая, тёмная или по настройке устройства) и меню пользователя с перечнем назначенных ролей, выбором языка интерфейса (русский, английский) и выходом из системы.
Ниже разделы описаны в том порядке, в котором они идут в боковом меню.
Раздел Обзор
Стартовый экран платформы со сводным дашбордом общего состояния: ключевые показатели, проблемы и аномалии по всем подключённым источникам с переходом к деталям по клику.
Раздел Приложения
В данном разделе доступен функционал Application Performance Monitoring и анализа ошибок приложений.
Подраздел Бизнес-приложения
Предоставляет данные для анализа производительности и ошибок в работе бизнес-приложений в разрезе окружения, команд и прочих параметров. На встроенных дашбордах представлены ключевые метрики, ошибки, аномалии в работе бизнес-приложений, с возможностью по клику перейти к анализу источника проблемы.
Подраздел Сервисы
Позволяет анализировать работу сервисов по ключевым показателям (метрики, ошибки, проблемы) в разрезе окружения, команд и прочих параметров. На встроенных дашбордах в режиме реального времени предоставляется информация для анализа метрик, ошибок, аномалий, трейсов, логов, взаимосвязей сервисов между собой и с компонентами инфраструктуры, событий и оповещений. Также в подразделе показываются подробные данные по производительности эндпоинтов и инстансов, включая Runtime метрики и приложений, развернутых в Kubernetes инфраструктуре.
Подраздел Ошибки
Сводная аналитика ошибок приложений: группировка по типам исключений, динамика, затронутые сервисы и эндпоинты, переход к трейсу и логам конкретной ошибки.
Подробнее в руководстве по аналитике ошибок.
Подраздел Внешние сервисы
Показывает производительность и доступность внешних HTTP-сервисов, к которым обращаются ваши приложения, — время ответа, коды ответов, ошибки.
Подробнее в руководстве по внешним HTTP-сервисам.
Подраздел Виртуальные базы данных
Показывает информацию по производительности баз данных, выявленную безагентным способом (путём анализа вызовов из подключённых приложений, без установки агента платформы на сервер БД).
Подраздел Очереди сообщений
Отображает работу с очередями сообщений со стороны приложений: производители и потребители, задержки и ошибки обработки.
Подробнее в руководстве по очередям сообщений.
Подраздел Настройки APM
Управление сегментами сервисов и порогами APDEX.
Раздел Цифровой опыт
В данном разделе доступен функционал Real User Monitoring и мониторинга мобильных приложений.
Подраздел Веб-приложения
Показывает ключевые показатели производительности и ошибки веб-приложений. На готовых дашбордах доступны данные для анализа работы frontend в разрезе страниц и версий. Представлена информация как по ключевым метрикам производительности, включая APDEX, Web Vitals, Frustration signals, так и по распределённым транзакциям, JS ошибкам, HTTP запросам, ресурсам, пользователям, браузерам, гео локациям.
Подраздел Мобильные
Предоставляет аналогичную информацию, что и подраздел Веб-приложения, но для мобильных приложений (iOS, Android), с дополнительными данными по падениям (Crash) и производительности экранов.
Подраздел Веб-транзакции
Ключевые бизнес-транзакции фронтенда — отдельная аналитика по важным для бизнеса пользовательским сценариям.
Подраздел JS ошибки
Реестр и анализ JavaScript-ошибок веб-приложений с группировкой, динамикой и деталями конкретной ошибки. Поддерживается приём ошибок из Sentry SDK (доступно с версии 202).
Подраздел Сессии
Инструмент поиска и анализа сессий пользователей: список сессий с фильтрами, таймлайн действий и воспроизведение записи сессии (session replay) (доступно с версии 201).
Подраздел Пути
Анализ путей пользователей (Customer Journey Map): визуализация типовых маршрутов по страницам приложения, точки оттока и переходы (доступно с версии 201).
Подробнее в руководстве по анализу путей пользователей.
Подраздел Настройки
Управление ключевыми бизнес-транзакциями фронтенда и правилами их автоматического определения.
Раздел Бизнес-аналитика
В данном разделе доступен функционал анализа бизнес-показателей поверх телеметрии приложений.
Подраздел Транзакции
Ключевые бизнес-транзакции (КБТ) — производительность и ошибки в разрезе бизнес-операций, а не технических эндпоинтов.
Подробнее в руководстве по мониторингу бизнес-операций.
Подраздел Бизнес-процессы
Сквозные бизнес-процессы, собранные из шагов: схема процесса, статистика прохождения, «застрявшие» и завершившиеся ошибкой потоки, переход от шага схемы к соответствующим потокам.
Подробнее в руководстве по мониторингу бизнес-процессов.
Подраздел Настройки
Управление КБТ, правилами их определения, бизнес-процессами и их шагами, а также правилами извлечения бизнес-данных из телеметрии.
Раздел Инфраструктура
Единый каталог источников инфраструктуры (доступно с версии 202). Раздел открывается витриной, на которой все поддерживаемые технологии сгруппированы по категориям:
- Хосты
- Сетевые устройства
- Проверки доступности (HTTP, DNS, TCP)
- Базы данных
- Кэш
- Очереди сообщений
- Веб-, прокси- и серверы приложений
- Системы виртуализации
- Big Data
- CI/CD
- Почта
- Service Mesh
- Прочее
Внутри каждой категории источники разделены на «Подключено» и «Доступно для подключения». Подключённые источники открывают свой встроенный дашборд или список экземпляров; для ещё не подключённых карточка ведёт на инструкцию по подключению в документации.
Обратите внимание
До версии 202 базы данных, сетевые устройства, очереди сообщений и веб-серверы были отдельными разделами бокового меню. Теперь они находятся внутри раздела Инфраструктура. Прежние адреса дашбордов продолжают работать.Хосты
Показывает по Linux и Windows серверам ключевые метрики производительности, анализ сети и дисков, события, проблемы, ошибки проверок, контейнеры относящиеся к хостам и многое другое.
Базы данных
Отображает данные по производительности баз данных (PostgreSQL, MySQL, MongoDB, Oracle, ClickHouse, Elasticsearch, MSSQL, DB2, Cassandra и других СУБД), на которых установлен агент observability платформы. По MySQL также предоставляется подробная аналитика по SQL-запросам и относящимся к ним ошибкам.
Системы виртуализации
Дашборды VMware vSphere (обзор vCenter, ESXi-хосты, дата-центры, кластеры, хранилища данных, виртуальные машины), а также Яндекс Облако и Базис.DynamiX. Объекты виртуализации обнаруживаются автоматически и попадают в РСМ (доступно с версии 201).
Сетевые устройства и проверки доступности
Мониторинг сетевого оборудования, а также активные проверки доступности по протоколам HTTP, DNS и TCP.
Раздел Kubernetes
В данном разделе доступен функционал мониторинга Kubernetes.
Подраздел Навигатор
Инвентарь объектов кластеров Kubernetes, собранный в одном экране с вкладками: Обзор, Кластеры, Рабочие нагрузки, Поды и Узлы. Позволяет переходить от кластера к неймспейсу, рабочей нагрузке, поду и его контейнерам. Объекты кластера автоматически попадают в ресурсно-сервисную модель (доступно с версии 201).
Подробнее в руководстве по Навигатору Kubernetes.
Подраздел Кластеры
Предоставляет данные по производительности Kubernetes кластеров и возникающих в них проблемах в разрезе нод, подов, деплойментов, даймонсетов.
Подраздел Неймспейсы
Показывает ключевые метрики производительности и проблемы по Kubernetes неймспейсам в разрезе подов, деплойментов, даймонсетов, сервисов.
Раздел Инциденты и Алерты
В данном разделе доступен функционал работы с инцидентами, создания оповещений и политик, анализа алертов.
Подраздел Инциденты
Показывает инциденты — автоматически скоррелированные группы связанных алертов с этапами жизненного цикла, ответственным, ИИ-сводкой и ИИ-расследованием первопричины (доступно с версии 201).
Подробнее в руководстве по инцидентам.
Подраздел Активные Алерты
Представляет собой консоль real time аналитики алертов с расширенными возможностями группировки и фильтрации оповещений и переходу по клику к дашборду источника проблемы.
Подраздел История Алертов
Предоставляет ключевые данные по сработавшим алертам — состояние, критичность, время начала и завершения, длительность, где сработал, ключевые проблемы и MTTR.
Подраздел Надёжность изменений
Показывает, сколько изменений выкатывается и сколько из них заканчивается инцидентом (метрики класса DORA). Раздел состоит из двух вкладок: сводная аналитика надёжности и журнал изменений. Считается по маркерам релизов и развёртываний и по инцидентам платформы, дополнительной настройки не требуется (доступно с версии 203).
Подраздел Правила
Предоставляет конструктор правил оповещений. Алерты возможно создавать как с помощью готовых шаблонов, доступных в этом разделе, в том числе путём их редактирования, так и создания собственных правил с нуля по любым показателям, включая бизнес KPI. Поддерживаются оповещения о пропадании данных (No-Data) (доступно с версии 202). В подразделе также показывается реестр всех правил с информацией по их типу, статусу, группе и т.п.
Подраздел Каналы оповещения
Позволяет создавать каналы оповещений, предоставляет реестр каналов оповещений с информацией в каких политиках используется канал, кто и когда изменял канал, какие действия были совершены.
Подраздел Политики оповещения
Предоставляет конструктор создания политик оповещений и их реестр.
Подраздел SLO
Позволяет описывать целевые уровни обслуживания (SLI/SLO), отслеживать бюджет ошибок и формировать отчёт о соответствии за произвольный период. Поддерживаются кастомные SLO на произвольном запросе PromQL (доступно с версии 201).
Подробнее в руководстве по SLO.
Подраздел Окна обслуживания
Позволяет задавать плановые окна обслуживания — на время окна уведомления по подпадающим под него алертам подавляются, а на графиках отображаются соответствующие маркеры (доступно с версии 202).
Подробнее в руководстве по окнам обслуживания.
Подраздел Настройки Инцидентов
Раздел для администраторов: переименование и переупорядочивание этапов жизненного цикла инцидента.
Раздел Дашборды и отчёты
Данный раздел позволяет просмотреть список кастомных дашбордов и создать новый дашборд в интерактивном режиме. Каждый дашборд состоит из виджетов двух типов — «Текст» и «График». Виджеты-графики поддерживают три источника данных: Стандартный (выбор метрик по сервисам и эндпоинтам), PromQL (произвольные запросы к метрикам Prometheus) и LogsQL (визуализация данных логов, доступно с версии 200). Также доступны специализированные виджеты — например, «Соты здоровья» — и инциденты в качестве источника данных (доступно с версии 202).

Вкладка Отчёты позволяет настроить регулярную рассылку дашборда по электронной почте: расписание, отчётный период и список получателей. Вкладка доступна администраторам при включённом RBAC (доступно с версии 202).
Подробнее в руководстве по дашбордам и руководстве по отчётам.
Раздел Трейсы
Раздел Трейсы (Traces Explorer) предоставляет интерфейс для поиска и анализа распределённых трейсов — записей прохождения запросов через цепочки сервисов. Позволяет искать трейсы по сервису, операции, длительности и статусу, просматривать временную шкалу (waterfall) и детали отдельных спанов, а также флейм-граф трейса и выгрузку трейса в открытых форматах (доступно с версии 202).
Подробнее в руководстве по Traces Explorer.
Раздел Метрики
Раздел Метрики предоставляет инструмент для работы с метриками Prometheus и состоит из трёх подразделов:
- Браузер — каталог всех доступных метрик с описаниями и типами.
- Конструктор — визуальный построитель PromQL-запросов и текстовый редактор PromQL с подсветкой синтаксиса, валидацией, объяснением и оценкой стоимости запроса. Результаты доступны в виде графиков, таблиц и статистики; поддерживаются избранные запросы и история запросов.
- Кардинальность — анализ кардинальности метрик: какие метрики и лейблы порождают больше всего временных рядов (доступно с версии 202).
Подробнее в руководстве по браузеру метрик.
Раздел Логи
Раздел Логи предоставляет интерфейс Logs Explorer для поиска, фильтрации и анализа лог-записей (доступно с версии 200). Доступны визуальный режим построения запросов и режим прямого ввода LogsQL. Результаты отображаются в виде гистограммы объёма логов и таблицы записей с цветовой индикацией уровней серьёзности; блок фильтров и пайпов сворачивается. Панель «Детали записи» показывает поля записи и связанный трейс.
Подробнее в руководстве по Logs Explorer.
Раздел РСМ (ресурсно-сервисная модель)
Раздел РСМ предоставляет единый реестр ИТ-ресурсов и их взаимосвязей (доступно с версии 200). Состоит из двух подразделов:
- Каталог ресурсов — создание ресурсов (серверы, сервисы, базы данных и другие элементы инфраструктуры) и управление ими, описание связей между ними и визуализация графа зависимостей.
- Настройки РСМ — управление справочниками: типами ресурсов, типами взаимосвязей, CI-классами и CI-подклассами.
Подробнее в руководстве по РСМ.
Раздел AI-аналитик
Чат по данным платформы: вопросы о состоянии сервисов на естественном языке, ответы со ссылками на конкретные сущности консоли (сервисы, хосты, инциденты). На старте предлагается набор готовых вопросов. Требует настроенной LLM (доступно с версии 203).
Раздел Роли и доступ
Раздел предоставляет полный набор инструментов для управления доступом (доступно с версии 200). Доступен только пользователям с правами администратора при включённом RBAC. Вкладки:
- Пользователи — приглашение, активация/деактивация, назначение ролей.
- Роли — системные и пользовательские роли.
- Разрешения — матрица разрешений.
- Внешние группы — сопоставление групп LDAP/OIDC с ролями платформы.
- Журнал аудита — история всех действий по управлению доступом (расширен в версии 202).
- Проверка на ПДн — выборочная проверка телеметрии на наличие персональных данных (доступно с версии 203).
Подробнее в руководстве по RBAC.
Раздел Диагностика
В данном разделе представлены сведения о работе самой платформы:
- Лицензия — параметры и срок действия лицензии.
- Объём данных — сколько телеметрии принимает и хранит платформа, в разрезе типов данных и источников. Доступно администраторам (доступно с версии 203).
- Processor — метрики работы компонентов обработки телеметрии.
- Реестр конфигурации — просмотр параметров конфигурации сервисов платформы с описаниями и фильтрами. Только чтение, доступно администраторам (доступно с версии 203).
- Логи бэкенда — логи работы платформы.