Сбой NFS парализовал кластер Proxmox: виртуальные машины ушли в «спящий режим»
Внезапный сбой NFS-сервера привел к остановке работы кластера Proxmox, поскольку виртуальные машины, подключенные через "hard" монтирование, перешли в состояние D-state и перестали реагировать.
Инцидент, описанный на Habr, затронул кластер Proxmox из четырех нод. После отказа NFS-сервера, который предоставлял хранилище для виртуальных машин, все ВМ оказались недоступны, а команды управления кластером перестали отвечать.
Причина проблемы заключалась в использовании опции "hard" при монтировании NFS. Этот режим заставляет клиентскую систему бесконечно ждать ответа от сервера, что в случае сбоя блокирует все операции. Виртуальные машины перешли в D-state – состояние неубиваемого сна, из которого их невозможно вывести без принудительной перезагрузки нод.
Эксперты подчеркивают, что использование "hard" монтирования в производственных средах несет высокие риски. Хотя оно обеспечивает целостность данных за счет постоянных попыток подключения, это может привести к полной неработоспособности системы при потере связи с хранилищем.


Комментарии (0)
Без регистрации. Комментарии проверяются автоматически перед публикацией.
Пока нет комментариев. Будьте первым!