Встречается на собеседованиях • сегодня

Куда смотреть, чтобы определить причину падения микросервиса

Основные направления для диагностики:

  1. Логи сервиса – ищите ошибки (ERROR, CRITICAL) и стектрейсы.
  2. Метрики – CPU, память, дисковое пространство, сетевые задержки (Prometheus, Grafana).
  3. Журналы оркестратора – Kubernetes (kubectl logs, describe pod) или Docker (docker logs).
  4. Внешние зависимости – проверьте доступность БД, API, брокеров сообщений (Kafka, RabbitMQ).
  5. Health checks – эндпоинты /health или /ready могут показать проблемы до падения.

Пример проверки логов в Python:

python
import logging

logging.basicConfig(
    level=logging.INFO,
    filename='service.log',
    format='%(asctime)s - %(levelname)s - %(message)s'
)

try:
    # Код сервиса
except Exception as e:
    logging.critical(f"Service crashed: {e}", exc_info=True)

Дополнительно: мониторьте ограничения ресурсов (OOMKiller, CPU throttling) и конфигурацию (env-переменные, файлы конфигов).

Sophi
Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
Попробовать бесплатноArrow

Следующий вопрос

Это единственный вопрос по вашему фильтру

как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы