База знаний VMmanager
Режим фокусировки

Ложный статус о недоступности узла в веб-интерфейсе

Проблема

Платформа отображает статус Недоступен для работающего узла кластера. Например, после восстановления доступа к ранее недоступным узлам кластера. При этом подключение по SSH и ping проходят успешно.

Причина

Службы мониторинга не обновляют статус узла кластера и продолжают использовать старые данные. 

Диагностика

Чтобы подтвердить причину:

  1. Подключитесь к серверу с платформой по SSH. Подробнее о подключении по SSH см. в статье Настройка рабочего места.
  2. Проверьте доступность узла кластера из контейнера vm_back:
    docker exec -it vm_back vssh <ID_узла> --check
    Пример вывода для недоступного узла
    ssh: connect to host 10.10.10.10 port 22: No route to host
    ssh: connect to host 10.10.10.10 port 22: No route to host
    Если вывод пустой, это значит, что узел кластера доступен и статус не соответствует реальности. Это подтверждает причину.

Решение

Чтобы решить проблему, перезапустите службы nodewatch, nodewarden и monitor:

  1. Подключитесь к серверу с платформой по SSH. Подробнее о подключении по SSH см. в статье Настройка рабочего места.
  2. Выполните следующие команды:
    docker exec -it nodewarden supervisorctl restart nodewarden
    docker exec -it nodewatch supervisorctl restart nodewatch
    docker exec -it vm_back supervisorctl restart monitor

    Ожидаемый результат: остановка и запуск служб.

    Пример вывода
    [root@VMmanager10 .ssh]# docker exec -it nodewarden supervisorctl restart nodewarden
    nodewarden: stopped
    nodewarden: started
    [root@VMmanager10 .ssh]# docker exec -it nodewatch supervisorctl restart nodewatch
    nodewatch: stopped
    nodewatch: started
    [root@VMmanager10 .ssh]# docker exec -it vm_back supervisorctl restart monitor
    monitor: stopped
    monitor: started

После перезапуска службы опросят все узлы кластера и обновят их статусы в веб-интерфейсе. 

Может быть полезно

Связанные статьи: