Event ID 1073 Failover Clustering: аварийная остановка службы кластера
Симптомы аварийной остановки кластера 1073
В журнале System фиксируется критическая ошибка Event ID 1073: The Cluster service was halted due to a cluster log request or an unhandled internal error. Diagnostic information has been dumped to the cluster log.
| Симптом | Последствия |
|---|---|
| Мгновенное падение ClusSvc | Узел неожиданно исключается из кластера |
| Перезапуск виртуальных машин | Нештатный Failover ролей на соседний узел с потерей текущих сессий |
| Генерация отладочного дампа | Создание объемных логов в папке C:\Windows\Cluster\Reports |
Пошаговый анализ и устранение сбоя Event ID 1073
Ошибка 1073 означает, что служба ClusSvc столкнулась с неустранимым несоответствием данных в глобальной очереди обновлений (Global Update Manager - GUM) или повреждением структуры кворума и намеренно аварийно завершила процесс для защиты целостности данных.
- Сгенерируйте и откройте кластерный лог:
# Генерация кластерного лога для поиска фатальной ошибки (FATAL / ASSERT):
Get-ClusterLog -Destination "C:\ClusterLogs" -TimeSpan 15
# Поиск фатальных ошибок в сгенерированном текстовом логе:
Select-String -Path "C:\ClusterLogs\*.log" -Pattern "FATAL", "ASSERT", "Halt", "Exception" | Select-Object Line -First 10- Проверьте свободное место на системном диске C: нехватка места для записи файла
CLUSDBприводит к моментальному Halt-сбою службы. - Проверьте задержки сети Heartbeat: задержки свыше 1000 мс приводят к рассинхронизации GUM:
# Проверка порогов задержки Heartbeat между узлами кластера:
(Get-Cluster).SameSubnetDelay
(Get-Cluster).SameSubnetThreshold
# Увеличение допустимого порога потерь пакетов для предотвращения ложных сбоев:
(Get-Cluster).SameSubnetThreshold = 20Внимание: Если сбой 1073 вызван повреждением файла CLUSDB, очистите узел командой Clear-ClusterNode и добавьте его в кластер заново с получением чистой реплики базы с ведущего узла.
Частые вопросы (FAQ)
Почему служба кластера сама вызывает Halt (остановку ядра)?
Это защитный механизм. Если узел получает команду обновления конфигурации, но не может подтвердить ее запись на диск, он обязан упасть, чтобы избежать рассинхронизации кластера.
Что такое Global Update Manager (GUM)?
Это протокол распределенного согласования изменений в кластере Windows. Он гарантирует, что любое изменение (создание ресурса, смена статуса) применилось на 100% узлов.
Как увеличить размер кольцевого буфера Cluster.log?
Выполните команду PowerShell: Set-ClusterLog -Size 2048 (размер в мегабайтах).
Где сохраняются отчеты валидации кластера?
В каталоге C:\Windows\Cluster\Reports\Validation Report [Дата].html.