Что это значит

Контейнер стартует и завершается с ошибкой, Kubernetes перезапускает его с растущей паузой до пяти минут. Само состояние причину не называет: она в логе предыдущего запуска или в коде выхода.

Для сервисов RX частые причины: недоступна база или брокер, неверная настройка или секрет, не проходит проверка готовности, не хватает памяти (код 137).

Как проверить

kubectl logs <под> --previous --tail=100
kubectl describe pod <под> | grep -A8 "Last State"
kubectl get events --sort-by=.lastTimestamp | tail -20

Ключ --previous важен: текущий контейнер мог ещё ничего не написать. В Last State смотрите Reason и Exit Code.

Что сделать

  1. Код 137 и OOMKilled: не хватает памяти, см. статью про OOMKilled.
  2. В логе ошибка подключения к базе или брокеру: сначала чинить их. Когда падают сразу все сервисы, причина почти всегда в общей зависимости.
  3. Контейнер убит проверкой (Liveness probe failed): сервис стартует дольше, чем ждёт проверка. Увеличить initialDelaySeconds или добавить startupProbe.
  4. Ошибка в настройках: сравнить с рабочим стендом, проверить секреты и переменные окружения.