Практикум по плановым работам
Обслуживание Windows-кластера: роли, запас ресурсов и возврат
Рассчитайте ресурс после вывода узла, разберите перенос ролей и CAU, выберите политику возврата. Проверка готовности и результат приложения рассматриваются отдельно.
Что вы сможете сделать
- Считать ресурс при обслуживании и дополнительном отказе.
- Различать паузу узла, перенос ролей и принудительный режим.
- Планировать обновление и проверять возврат приложения.
Работа остаётся на других серверах
Сначала нужна карта ролей и ресурсов, потом команда обслуживания.
В плане укажите роли, разрешённые узлы назначения и доступные ресурсы каждого узла: CPU, память, пути к данным и сеть. Отметьте общие контроллеры, коммутаторы и другие зависимости. Перенос программы на другой сервер не создаёт недостающий ресурс.
В упражнении узел А выводится на обслуживание. Три роли по 24 ГиБ можно разместить так: две на Б с бюджетом 48 ГиБ, одну на В с бюджетом 32 ГиБ. Это проверка заданной памяти; пригодность процессоров, устройств, хранилища и сети не доказана этим расчётом.
Отдельный сценарий — потеря Б, пока А обслуживается. На В останется 32 ГиБ против требуемых 72 ГиБ. План выдерживает вывод одного узла по памяти, но не этот дополнительный отказ. Не выдавайте обслуживание за сохранение прежнего запаса отказоустойчивости.
Пауза узла и перенос ролей
Следующие механизмы относятся только к Windows Server Failover Clustering.
Suspend-ClusterNode приостанавливает узел; Drain добавляет перенос ролей перед паузой. Запись «узел приостановлен» не заменяет проверку переноса. Начало работ связывают с подтверждённым результатом, а не только с названием состояния.
ForceDrain не исправляет несовместимость назначения: неудачно переносимая нагрузка может быть остановлена. В плане предусмотрите допустимый перерыв и критерий прекращения работ, если перенос не удался. Принудительный вывод не является тестом непрерывности.
Координатор и порядок обновления
CAU управляет порядком работ, но не отменяет проверку системы.
В режиме самообновления CAU работает внутри обновляемого кластера; для удалённого обновления нужен компьютер-координатор вне его состава. Проверьте расположение этого компьютера и доступ к узлам. Само внешнее размещение не доказывает независимость питания.
Описанный цикл CAU переносит роли, обновляет узел и перезапускает его при необходимости, затем возвращает узел с ролями и продолжает работы. Плановый перенос может прервать клиентское обслуживание. Обещание нулевого перерыва требует доказательства для конкретной нагрузки.
С Microsoft.WindowsUpdatePlugin не совмещайте цикл CAU с независимой автоматической установкой обновлений по расписанию узлов. Рекомендация касается установки; загрузка файлов с отдельным подтверждением установки — другой режим. Расписания согласуют до работ.
Вернуть узел и проверить приложение
Возобновление узла и возврат его прежних нагрузок — разные решения.
При ручном возврате через Resume-ClusterNode заранее выберите Failback: NoFailback, Immediate или Policy. Не выводите немедленный возврат ролей из одного сообщения о возобновлении узла. Эти значения не описывают политику Proxmox или Ceph.
Microsoft рекомендует повторять проверку готовности CAU после добавления узла и аппаратных изменений, требующих проверки конфигурации кластера. Это не испытание установленного драйвера, прошивки или приложения. Для стороннего модуля обновлений нужны его собственные условия.
Авторский протокол отдельного стенда: сохранить исходный состав и контрольную операцию приложения; выполнить обслуживание одного узла; проверить его возврат, состояние данных и путей; измерить клиентский перерыв и повторить операцию. При ошибках или неизвестном состоянии данных не переходить к следующему узлу. Это критерий приёмки автора, а не доказанное автоматическое поведение CAU.
Проверьте инженерное мышление
Вопросы проверяют не память на аббревиатуры, а умение не делать лишних выводов.
Следующий шаг
Сформулируйте задачу и уточните требования к своей системе.
Подготовить состав проектаОткроется черновик вопроса. Отправьте его, когда будете готовы.
Источники курса
Ссылки приведены один раз для всего курса, чтобы не мешать чтению каждого тезиса.
- Официальная документация
Suspend-ClusterNode — FailoverClusters
Microsoft · Справочник Windows Server 2025 PowerShell; веб-редакция на дату чтения
Проверены Description, Drain и ForceDrain. Противоречивое описание типа Wait не используется; параметры не исполнялись.
Открыть первоисточник - Официальная документация
Cluster-Aware Updating requirements and best practices
Microsoft · Веб-страница, обновлена 22.10.2021; содержит исторические таблицы версий
Использованы разделы рекомендаций и проверки готовности; устаревшая таблица Windows Server 2012–2016 не принята за предел поддержки 2025.
Открыть первоисточник - Официальная документация
Cluster-Aware Updating overview
Microsoft · Веб-страница, обновлена 29.03.2022; в Applies to указан Windows Server 2025
Проверены последовательность, кратковременный перерыв и расположение координатора. Не источник совместимости конкретных драйверов или прошивок.
Открыть первоисточник - Официальная документация
Resume-ClusterNode — FailoverClusters
Microsoft · Справочник Windows Server 2025 PowerShell; веб-редакция на дату чтения
Проверены возобновление узла и явные значения Failback. Поведение без явно выбранной политики не выводится.
Открыть первоисточник