Главная / Справочник ошибок / Хранилище
NFS-сервер перестал отвечать, процессы зависли на чтении и записи
nfs: server not responding, still trying
Сообщение ядра «nfs: server … not responding, still trying»: клиент не получает ответа от NFS-сервера. Процессы, которые обращаются к общей папке, зависают. Что проверить и почему важны параметры монтирования.
Что это значит
Сервер Directum RX или узел Kubernetes обращается к общей папке по NFS, а NFS-сервер не отвечает. При монтировании с параметром hard (по умолчанию) клиент ждёт бесконечно и повторяет запросы. Процессы, которые читают или пишут в эту папку, зависают в состоянии D, их не убить. Когда сервер вернётся, в журнале появится nfs: server … OK, и всё продолжится.
Как проверить
- Журнал ядра на клиенте:
dmesg -T | grep -i nfs
- Доступность сервера и порта:
rpcinfo -p <сервер>,nc -zv <сервер> 2049. - Повторные отправки на клиенте:
nfsstat -rc. Ростretransозначает потери в сети или перегруженный сервер. - Нагрузка и диски на самом NFS-сервере.
Что сделать
- Вернуть NFS-сервер или сеть до него. Зависшие процессы продолжат работу сами.
- Не использовать
softдля данных, где важна целостность: при таймауте запись тихо потеряется. - Задать разумные
timeoиretransи следить за повторными отправками в мониторинге: рост ретрансмитов заранее показывает проблемы с сетью или сервером.
Ошибка повторяется?
Запустите Диагностика: за полминуты он покажет состояние базы, брокера, поиска и сервера. С отчётом разберём причину за 30 минут бесплатного созвона.
Написать