Узел выполняет Pod, кластер управляет их созданием и размещением. Отказ узла требует новой проверки ресурсов и зависимостей на оставшихся узлах; наличие кластера не переносит память процесса.
Почему это важно
Паспортные CPU и RAM нельзя целиком обещать приложениям. Учитывайте системные службы и пороги вытеснения, затем проверяйте размещение после отказа узла. Запуск замены требует ресурсов, образа и данных на другом узле; работа старого экземпляра этого не доказывает.
Что подтверждено
Службы узла Kubernetes поддерживают назначенные ему Pod и взаимодействуют со средой выполнения. Назначение связывает конкретный Pod с выбранным узлом.
Граница применимости: Компоненты узла и назначение Pod Kubernetes.
Pod не переносится на другой узел с прежним UID. Для управляемой нагрузки контроллер может создать новый Pod взамен потерянного; он получает новый UID и проходит отдельное размещение.
Граница применимости: Жизненный цикл Pod Kubernetes; создание замены требует подходящего контроллера.
Node Allocatable — ресурсы узла, доступные для Pod после системных резервов и предусмотренных порогов вытеснения. Они могут быть меньше общей мощности процессора и установленной памяти.
Граница применимости: Модель резервирования вычислительных ресурсов Kubernetes.
Фаза Running означает, что Pod назначен узлу, контейнеры созданы и хотя бы один выполняется, запускается или перезапускается. Это не подтверждает готовность приложения принимать запросы.
Граница применимости: Фазы жизненного цикла Pod Kubernetes; готовность отражается отдельными условиями.
Новый Pod не наследует память процесса прежнего экземпляра. Данные временного тома, связанного с жизнью старого Pod, также нельзя считать автоматически перенесёнными на другой узел.
Граница применимости: Замена Pod Kubernetes; постоянные тома и восстановление данных имеют отдельные правила.
Планировщик распределяет Pod по значениям меток топологии. Физическая область отказа определяется общими зависимостями оборудования. Поэтому разные метки узлов или зон не подтверждают независимость питания и сети: метки нужно сверять с устройством инфраструктуры.
Граница применимости: Редакторское сопоставление меток топологии Kubernetes и физических областей отказа в документации Microsoft. Механизмы отказоустойчивого кластера Windows не переносятся на Kubernetes; проверяется соответствие меток реальной инфраструктуре.
На узле с 32 ГиБ RAM и Node Allocatable=28Gi шесть Pod с запросами по 5 ГиБ требуют 30 ГиБ и не помещаются. Установленная память не отменяет предел размещения: считайте по объёму, доступному для Pod.
Граница применимости: Учебный расчёт памяти по контейнерным requests без ресурсов уровня Pod, init-контейнеров, дополнительных накладных расходов и иных нагрузок. 32 ГиБ и 28Gi заданы в примере, а не объявлены стандартным резервом.
Не путать
Что проверить
- Сверьте общие ресурсы узла и Node Allocatable.
- Проверьте резервы для kubelet, среды выполнения и системных служб.
- Сохраните условия узла и список назначенных ему Pod.
- Проверьте метки размещения по фактической топологии инфраструктуры.
- Уточните, какие данные переживут удаление Pod и потерю узла.
- Испытайте получение образа и подключение данных на узле замены.
- Измерьте восстановление пользовательского запроса, а не только появление Running.
Первоисточники
Kubernetes Components
Kubernetes · Kubernetes current documentation
Описывает управляющие компоненты, узлы, сервер API, планировщик, контроллеры, kubelet и среду выполнения контейнеров.
Открыть первоисточникPod Lifecycle
Kubernetes · Kubernetes current documentation
Описывает назначение узла, состояния Pod и контейнеров, перезапуски контейнеров и создание нового Pod с другим UID взамен прежнего.
Открыть первоисточникReserve Compute Resources for System Daemons
Kubernetes · документация Kubernetes v1.37, страница открыта 6 сентября 2026 года
Открыт редактором 6 сентября 2026 года, заголовок и версия документа сверены. Node Allocatable: ресурсы для Pod после резервов системных служб и порогов вытеснения.
Открыть первоисточникPod Topology Spread Constraints
Kubernetes · документация Kubernetes v1.37, страница открыта 6 сентября 2026 года
Открыт редактором 6 сентября 2026 года, заголовок и версия документа сверены. Распределение Pod по меткам узлов и доменам отказа; жёсткое и мягкое требование.
Открыть первоисточникFailover Clustering topologies
Microsoft · Microsoft Learn для Windows Server 2016–2025, проверено 29 августа 2026 года
Определяет fault domains и показывает границу single-rack HA, stretch cluster и multi-site DR.
Открыть первоисточникResource Management for Pods and Containers
Kubernetes · Kubernetes current documentation
Разделяет запросы и ограничения CPU и памяти: их учёт при размещении, распределение процессорного времени и применение пределов на узле.
Открыть первоисточник