Балансер сам по себе не гарантирует аптайм — он раскидывает трафик, но плохо понимает, что нода мертва именно для российских клиентов. Показываю, как я проверяю здоровье из РФ-точки, как механически вывожу мёртвую ноду из ротации и как держу горячий резерв входов, чтобы блок не превращался в простой. Команды рабочие.
Слепое пятно observatory
Главная ловушка отказоустойчивости: встроенный наблюдатель Xray (observatory/burstObservatory) пингует членов пула с самой ноды. А нода может быть жива в мире, но зарезана ТСПУ именно для российских клиентов. С точки зрения ноды всё отлично — она видит generate_204 и считает себя здоровой. С точки зрения клиента из РФ — мёртвая.
Вывод, из которого растёт вся правильная схема: проверять здоровье надо из РФ, а не только глобально. Нужен внешний воркер с российской точки, который бьёт в :443 каждой ноды и меряет реальную доступность для целевой аудитории.
Внешняя проба из РФ-точки
Простейший healthcheck — с российского сервера (или другого своего РФ-узла) проверяем порт каждой ноды:
ЗАКРЫТЫЙ РАЗДЕЛ
Дальше — после оплаты
Разовый платёж 4 000 ₽ открывает эту статью и ещё ~108 гайдов с замерами. Навсегда, без подписки.