Сбои Cluster-Aware Updating (CAU): исправление ошибок обновления кластера
Симптомы сбоев механизма Cluster-Aware Updating (CAU)
При запуске процесса скоординированного обновления кластера (Cluster-Aware Updating) процедура прерывается с ошибкой. В журнале Microsoft-Windows-ClusterAwareUpdating/Admin регистрируются события Event ID 1008: Cluster-Aware Updating failed to update the cluster, Event ID 1013 или узел кластера зависает в режиме Node Draining (Очистка узла).
| Симптом | Источник ошибки | Причина |
|---|---|---|
| Event ID 1008 / 1013 | CAU Admin Log | Не удалось перенести кластерные роли с обновляемого узла |
| Отказ создания объекта-компьютера CAU | Active Directory | Недостаточно прав у кластерного сетевого имени (CNO) на создание VCO |
| Таймаут перехода в режим обслуживания | ClusSvc | Виртуальная машина блокирует миграцию из-за примонтированного локального ISO |
Пошаговое восстановление работы Cluster-Aware Updating
- Проверьте готовность кластера к автоматическому обновлению:
Test-CauSetup -ClusterName "Cluster01" -Verbose - Устраните блокировки перемещения виртуальных машин: найдите ВМ, которые не могут быть смигрированы (например, с подключенными локальными DVD/ISO или Pass-Through дисками):
Get-ClusterGroup | Where-Object { $_.OwnerNode.Name -eq "Node01" -and $_.State -ne "Online" } - Проверьте права учетной записи кластера в AD (CNO/VCO): убедитесь, что учетная запись кластера имеет право
Create Computer Objectsв том подразделении (OU), где расположен кластер. - Запустите процесс CAU с увеличенными интервалами ожидания миграции:
Invoke-CauRun -ClusterName "Cluster01" -CauPluginName "Microsoft.WindowsUpdatePlugin" -MaxRetriesPerNode 3 -NodeDrainTimeoutMinutes 30 -Force
Совет: Если CAU запущен в режиме Self-Updating (самообновление), убедитесь, что кластерная роль CAU находится в режиме Онлайн и диск-кворум доступен.
Частые вопросы (FAQ)
В каких режимах может работать Cluster-Aware Updating?
В двух режимах: Self-Updating (кластер сам обновляет свои ноды по расписанию через внутреннюю роль) и Remote-Updating (администратор запускает процесс с удаленного ПК через RSAT).
Почему процесс очистки узла (Node Drain) зависает?
Чаще всего из-за виртуальных машин, которые не поддерживают Live Migration, либо при нехватке оперативной памяти на остальных узлах кластера для приема нагрузки.
Как принудительно вывести узел из состояния приостановки после сбоя CAU?
Выполните команду PowerShell: Resume-ClusterNode -Name 'NodeName' -Failback Immediate.
Где CAU ищет обновления по умолчанию?
По умолчанию используется стандартный Windows Update / WSUS-сервер, прописанный в групповых политиках узлов кластера.