Проблема
Платформа отображает статус Недоступен для работающего узла кластера. Например, после восстановления доступа к ранее недоступным узлам кластера. При этом подключение по SSH и ping проходят успешно.
Причина
Службы мониторинга не обновляют статус узла кластера и продолжают использовать старые данные.
Диагностика
Чтобы подтвердить причину:
- Подключитесь к серверу с платформой по SSH. Подробнее о подключении по SSH см. в статье Настройка рабочего места.
- Проверьте доступность узла кластера из контейнера vm_back:
docker exec -it vm_back vssh <ID_узла> --checkЕсли вывод пустой, это значит, что узел кластера доступен и статус не соответствует реальности. Это подтверждает причину.Пример вывода для недоступного узлаssh: connect to host 10.10.10.10 port 22: No route to host ssh: connect to host 10.10.10.10 port 22: No route to host
Решение
Чтобы решить проблему, перезапустите службы nodewatch, nodewarden и monitor:
- Подключитесь к серверу с платформой по SSH. Подробнее о подключении по SSH см. в статье Настройка рабочего места.
- Выполните следующие команды:
docker exec -it nodewarden supervisorctl restart nodewarden docker exec -it nodewatch supervisorctl restart nodewatch docker exec -it vm_back supervisorctl restart monitorОжидаемый результат: остановка и запуск служб.
Пример вывода[root@VMmanager10 .ssh]# docker exec -it nodewarden supervisorctl restart nodewarden nodewarden: stopped nodewarden: started [root@VMmanager10 .ssh]# docker exec -it nodewatch supervisorctl restart nodewatch nodewatch: stopped nodewatch: started [root@VMmanager10 .ssh]# docker exec -it vm_back supervisorctl restart monitor monitor: stopped monitor: started
После перезапуска службы опросят все узлы кластера и обновят их статусы в веб-интерфейсе.
Может быть полезно
Связанные статьи: