Агальцов Антон | TeamLead-блог
🔍 Наблюдаемость: понимать систему, не вскрывая её
Наблюдаемость (observability) — свойство системы, по которой о её внутреннем состоянии можно судить по внешним сигналам: логам, метрикам и трассировкам. Термин пришёл из теории управления 1960-х, а сегодня это одна из сквозных забот распределённой архитектуры.
Мониторинг и наблюдаемость — не синонимы. Мониторинг отвечает на вопросы, сформулированные до инцидента: диск заполнен, растут ошибки, задержка выше порога. Наблюдаемость позволяет расследовать отказы, которые никто не предвидел, — без релиза с «добавленным логированием» и ожидания повторения сбоя.
Три кита — логи, метрики, трассировки — различаются природой данных: агрегаты против событий, дешёвое хранение против дорогого, готовые дашборды против произвольных вопросов. Связывает их единый trace_id, который проходит сквозь все сервисы вместе с запросом.
💡 Наблюдаемость — не продукт, который можно купить, а свойство дизайна: тонна несвязанных данных не отвечает на вопросы лучше скромного, но связанного набора сигналов.
🔗 Подробнее: https://agaltsovav.ru/docs/architecture/observability/ Если у вас установлено приложение,
вы можете сразу перейти в канал