Падение BIHA кластера - как восстановить?

Падение кластера BIHA – потерян слот - разъехался timeline. Потерян слот репликации. Как восстановить?                                                                              Шаги восстановления:                                                                              1. Останавливаем службу на ноде с ошибкой:                                                                              sudo systemctl stop postgrespro-ent-17                                                                              2. Запускаем утилиту восстановления pg_rewind      /opt/pgpro/ent-17/bin/pg_rewind --biha_db --target-pgdata=/var/lib/pgpro/ent-17/data --source-server='user=biha_replication_user host=[ip адрес живого сервера] port=5432 dbname=postgres'

В данном скрипте мы указываем:

  • Расположение директории базы на сломанной ноде
  • Указываем пользователя, под которым была настроена репликация
  • Указываем host живой ноды

3. Запускаем службу postgresql на сервере со сломанной репликацией        sudo systemctl start postgrespro-ent-17

4. Проверяем кластер          Заходим в базу BIHA:

/opt/pgpro/ent-17/bin/psql -d biha_db                                   Проверяем статус SQL запросом:                                                                SELECT * FROM biha.status_v;

Падение BIHA кластера - как восстановить? | Сетка — социальная сеть от hh.ru