Клиент — интернет-магазин с собственным сервером — хотел не узнавать о падении сайта от покупателей, а видеть проблему раньше них. Нужен был единый экран с состоянием сервисов, нагрузкой и историей инцидентов, без сложной внешней системы мониторинга.
Собрал дашборд: статусы ключевых сервисов (веб-сервер, база данных, API, очередь задач) с аптаймом за 30 дней, графики CPU/RAM/диска и времени отклика с наведением по точкам, и ленту инцидентов с таймстампами и причиной. Данные в демо смоделированы и честно подписаны как демо — под реальный сервер клиента дашборд подключается к его метрикам напрямую.
Готовый пример того, как выглядит настройка мониторинга: заказчик получает не набор графиков в чужом интерфейсе, а свой собственный экран с тем, что важно именно ему, и уведомлением, когда что-то пошло не так.