Beget научил Kubernetes чинить сломанные ноды сам
В Managed Kubernetes от Beget появился автохилинг worker-нод: если нода перестаёт отвечать, платформа сама её восстанавливает, без ручного вмешательства.
Если нода молчит больше 15 минут, ей присваивают статус NotReady, поды переезжают на другие ноды группы, а неисправную удаляют и создают новую с той же конфигурацией. Автохилинг включается отдельно для каждой worker-группы. Ограничения: срабатывает только при отказе одной ноды, локальный диск при замене стирается безвозвратно, а для непрерывной работы в группе нужно минимум две ноды.
В Managed Kubernetes от Beget появился автохилинг worker-нод: если нода перестаёт отвечать, платформа сама её восстанавливает, без ручного вмешательства.
Если нода молчит больше 15 минут, ей присваивают статус NotReady, поды переезжают на другие ноды группы, а неисправную удаляют и создают новую с той же конфигурацией. Автохилинг включается отдельно для каждой worker-группы. Ограничения: срабатывает только при отказе одной ноды, локальный диск при замене стирается безвозвратно, а для непрерывной работы в группе нужно минимум две ноды.