Блог
deckhouse_new

В Deckhouse Observability Platform добавлен модуль APM для мониторинга производительности приложений

3 мин

Разработчик программного обеспечения Deckhouse расширил возможности Deckhouse Observability Platform: в платформе появился модуль APM для мониторинга производительности приложений. Он помогает командам быстрее разбирать инциденты в распределённых системах и связывать состояние инфраструктуры с работой сервисов, запросов и зависимостей между ними.

В микросервисной архитектуре обработка запроса охватывает множество узлов: API-шлюзы, прикладные сервисы, базы данных и очереди сообщений. При возникновении задержек инфраструктурные метрики фиксируют общую деградацию отклика. Новый модуль APM автоматизирует поиск первопричины сбоя за счёт анализа распределённых трассировок и их связывания с логами внутри единого контура платформы.

Для оценки работоспособности сервисов или приложений платформа предоставляет карту сервисов и зависимостей между ними с расчётом ключевых показателей. На графе отображаются связи между сервисами, а внешние API, кеши и базы данных распознаются по атрибутам исходящих вызовов и выделяются в отдельные узлы. Инженеры сразу видят проблемный участок цепочки вызовов и оценивают масштаб влияния деградации на смежные компоненты.

Детальный разбор инцидентов реализован через фильтрацию трассировок по имени сервиса, статусу операции или длительности запроса. Путь транзакции визуализируется с помощью дерева операций, которое высчитывает собственное время выполнения каждого шага и подсвечивает ресурсоёмкие этапы. Интеграция телеметрии работает напрямую при наличии атрибута trace_id в логах приложения. Специалист открывает записи журнала, сгенерированные в момент ошибки, из окна проблемной трассировки.

В распределённых приложениях сложность диагностики заключается в разрозненности данных. Метрики показывают симптом, трассировки — путь запроса, логи — детали ошибки. Инженеру приходится вручную собирать разрозненные факты в общую картину. Внедрение APM делает этот разбор прикладным: инструмент показывает состояние сервисов, зависимости между ними, ресурсоёмкие операции и связанные логи в одном интерфейсе. Объединение контекста помогает командам DevOps и SRE быстрее локализовать узкое место и сократить время устранения инцидента.

Владимир Гурьянов, технический директор продукта Deckhouse Observability Platform компании «Флант»

О компаниях

Deckhouse — российский разработчик решений для построения надёжной enterprise-инфраструктуры. Лидер рынка DevOps и № 1 контрибьютор Kubernetes в России. Решения Deckhouse более 8 лет в эксплуатации. За это время проведено более 260 внедрений, есть референсные клиенты из разных отраслей. Продукты Deckhouse позволяют безопасно разрабатывать и доставлять Cloud Native-приложения, эксплуатировать legacy-приложения, облегчить и ускорить переход с монолита на микросервисы. В экосистему бренда входят решения для контейнеризации и виртуализации ИТ-ресурсов, мониторинга инфраструктуры и приложений, а также хранения секретов и управления ими. 

«Флант» — ИТ-компания, более 17 лет занимается созданием и обслуживанием инфраструктуры любого масштаба, лидер DevOps и Kubernetes в России. С 2017 года компания развивает экосистему продуктов Deckhouse. В неё входят ведущая Kubernetes-платформа в России Deckhouse Kubernetes Platform, решения для виртуализации, мониторинга, хранения секретов, управления версиями кода и другие инструменты для разработки, доставки и эксплуатации приложений. Кроме того, «Флант» предоставляет услуги по DevOps-сопровождению инфраструктуры и консультирует другие компании по DevOps-практикам и технологиям.

Мы используем файлы cookie, чтобы сделать работу с сайтом удобнее.
Подробнее — в политике обработки персональных данных и политике использования файлов cookie.

Помогите нам сделать сайт удобнее — поделитесь своим мнением в нашем исследовании.
Мы будем очень признательны и предложим полезные бонусы!