Мониторинг доступности с Uptime Kuma
Не каждому проекту нужен тяжёлый стек метрик. Часто достаточно знать простое: работает сервис или нет, и узнать об этом раньше пользователей. Для этого хорошо подходит Uptime Kuma.
Запуск за пять минут
docker run -d --restart=unless-stopped \
-p 127.0.0.1:3001:3001 \
-v uptime-kuma:/app/data \
--name uptime-kuma louislam/uptime-kuma:1
Дальше — веб-интерфейс, где добавляются проверки HTTP, TCP-порта или пинга с нужным интервалом.
Проверяйте то, что видит пользователь
Полезнее всего проверки, которые повторяют путь пользователя: не «жив ли процесс», а «отдаёт ли страница код 200 и ожидаемый ответ». Так вы поймаете случаи, когда процесс запущен, а сервис на самом деле сломан.
История и ложные срабатывания
Инцидент важно не только заметить, но и разобрать позже. Храните историю проверок и держите разумный интервал: слишком частые проверки с коротким таймаутом на медленной сети дают ложные «падения». Мы обычно ставим интервал 60 секунд и таймаут с запасом, чтобы всплеск задержки не поднимал тревогу зря.