Event ID 1230 Failover Clustering: критический таймаут дискового ввода-вывода
Симптомы дискового дедлока (Event ID 1230)
В журнале System регистрируется критическая ошибка Event ID 1230: The cluster resource [Имя_диска] of type 'Physical Disk' failed. A deadlock or excessive delay was detected during an I/O operation to the disk device. Кластер фиксирует зависание операций чтения/записи на уровне драйвера диска.
| Симптом | Последствия |
|---|---|
| Дисковый ресурс принудительно переводится в сбой | Служба кластера аварийно изолирует диск для защиты от зависания всей ОС |
| Падение виртуальных машин Hyper-V | Сбой работы виртуальных жестких дисков VHDX на общем томе CSV |
| Ошибки storport / disk (Event 129 / 153) | Драйвер контроллера сбрасывает команды I/O по таймауту (Reset to device) |
Пошаговое устранение дисковых таймаутов (Event ID 1230)
- Проверьте задержки дисковой подсистемы (Disk Latency) и очереди:
# Проверка среднего времени отклика диска через системные счетчики:
Get-Counter -Counter "\PhysicalDisk(*)\Avg. Disk sec/Read", "\PhysicalDisk(*)\Avg. Disk sec/Write"(Значения выше 0.050 (50 мс) считаются критическими для кластерных нагрузок).
- Увеличьте таймаут ожидания дисковых операций в реестре:
# Увеличение стандартного дискового таймаута TimeOutValue до 60 секунд (PowerShell):
Set-ItemProperty -Path "HKLM:\SYSTEM\CurrentControlSet\Services\Disk" -Name "TimeOutValue" -Value 60 -Type DWord -Force- Обновите прошивку контроллеров HBA / RAID и драйвер Storport: установите самые актуальные версии драйверов Fibre Channel / SAS адаптеров от вендора оборудования (HPE, Dell, Lenovo).
- Проверьте состояние дискового пула Storage Spaces Direct (S2D) (если используется гиперконвергентная архитектура):
# Проверка статуса физических накопителей в пуле S2D:
Get-PhysicalDisk | Select-Object DeviceId, FriendlyName, OperationalStatus, HealthStatus, MediaTypeСовет: Если ошибка 1230 возникает во время создания теневых копий VSS или работы резервного копирования, разнесите расписание бекапов разных виртуальных машин во времени, чтобы избежать шторма ввода-вывода (I/O Storm).
Частые вопросы (FAQ)
Что такое дисковый дедлок (I/O Deadlock) в кластере?
Это ситуация, когда поток монитора кластера отправляет команду проверки доступности диска (IsAlive / LooksAlive), но драйвер хранилища не возвращает ответ в течение установленного лимита времени.
Связана ли ошибка 1230 с ошибкой Storport 129?
Да, Event ID 129 ('Reset to device, \Device\RaidPortX, was issued') почти всегда предшествует ошибке 1230 в кластере.
Как проверить настройки тайм-аута монитора ресурсов диска?
Выполните команду: (Get-ClusterResource -Name "Cluster Disk 1").DeadlockTimeout.
Может ли перегрузка сети iSCSI вызывать ошибку 1230?
Да, потеря кадров в сети 10GbE/25GbE iSCSI без настроенного Flow Control приводит к таймаутам TCP и дедлокам на уровне SCSI.