Event ID 5121 CSV: Прямой доступ к тому кластера перенаправлен (Redirected I/O)
Архитектура общих томов кластера (CSV) и режимы I/O
Событие 5121 логируется в System источником Microsoft-Windows-FailoverClustering. Сообщение: «Прямой доступ к общему тому кластера (CSV) [Имя Тома] был изменен. Режим перенаправленного доступа (Redirected Access) включен/выключен». Архитектура CSV позволяет узлам Hyper-V напрямую писать данные в SAN-хранилище по оптике (FC) или iSCSI. Это называется Прямой доступ (Direct I/O). Если узел по какой-то причине теряет связь с диском, кластер не роняет виртуальные машины (как при ошибке >5120). Он включает защитный механизм: Redirected I/O.
Симптомы перенаправления (Impact)
Узел А просит соседний Узел Б (у которого связь с СХД жива) писать данные за него. Весь дисковый трафик Узла А заворачивается в локальную сеть кластера по протоколу SMB. ВМ не падают, но производительность падает катастрофически (в 5-10 раз). 1С зависает, SQL-запросы выпадают в таймаут.
Пошаговое дерево решений (Возврат к Direct I/O)
Сценарий 1: Восстановление MPIO путей (Отвал СХД)
Событие 5121 — это "желтый" алерт, спасающий вас от "красного" 5120. Ядро кластера изолировало проблему MPIO.
- Откройте PowerShell и введите
mpclaim -s -d(или откройте MPIO оснастку). - Проверьте статусы путей к дискам. Если статус 'Failed' или 'Standby' — проблема в кабелях, свитчах SAN или iSCSI таргетах на самой СХД.
- Как только физический линк восстановится, кластер сам выключит Redirected Access (сгенерировав еще одно событие 5121) и вернется к прямому I/O.
Сценарий 2: Блокировка резервным копированием (VSS)
Самая частая штатная причина. Когда система бэкапа (Veeam) делает моментальный снимок тома CSV на уровне софта (Software VSS), кластерный координатор (Coordinator Node) переводит CSV-том в режим перенаправленного доступа на время создания снимка (обычно на 30-60 секунд).
- Решение: Если 5121 появляется только ночью в часы бэкапа и длится не дольше минуты — это нормальная работа (By Design). Если том зависает в этом режиме на часы — VSS-провайдер завис. Перезапустите службу Теневое копирование томов (vss).
Сценарий 3: Запуск CHKDSK на томе кластера
Если вы (или кластер принудительно) запустили проверку диска chkdsk на томе CSV, он всегда будет переведен в Redirected Access. Ядро блокирует прямой доступ для защиты файловой системы (Metadata I/O) на время ремонта.
Типовые ошибки администраторов
- Объединение сетей CSV и Management: Если том работает в режиме Redirected Access, он гонит гигабайты дискового трафика через локальную сеть. Если у вас нет выделенной сети 'Только для связи кластера (Cluster Only)', этот трафик "задушит" сеть Heartbeat, и кластер полностью развалится с >ошибкой 1135 (Узел изолирован).
Незаметный переход CSV томов в перенаправленный режим — скрытый 'убийца' производительности. Возьмем виртуальную инфраструктуру на 2-ю линию поддержки: разнесем трафик по VLAN, настроим SMB Direct (RDMA/RoCE) для сверхбыстрого перенаправления, оптимизируем MPIO и вылечим VSS-провайдеры СХД.
Частые вопросы (FAQ)
Почему в 5121 указано 'Сбой при проверке работоспособности' (Health Check Failed)?
Кластер регулярно проверяет I/O задержки. Если СХД отвечает дольше 15-20 секунд, кластер считает, что путь 'умер', и превентивно переводит I/O в SMB, чтобы спасти ВМ от Синего экрана (BSOD 0x7A).
Как вручную выключить Redirected Access?
В Failover Cluster Manager перейдите в Storage -> Disks. Нажмите правой кнопкой на проблемный CSV-том. В меню должно быть 'Turn Off Redirected Access'. Если кнопка серая — кластер считает, что пути MPIO физически мертвы.
Влияет ли 5121 на Storage Spaces Direct (S2D)?
В кластерах S2D гиперконвергентной инфраструктуры Redirected I/O — это базовая механика работы (узлы постоянно читают данные с дисков друг друга по SMB). Для S2D это событие менее критично, но скачок задержек все равно требует внимания к сети RDMA.
Поможет ли перезагрузка узла?
Обычно нет. Режим Redirected Access управляется узлом-координатором (Coordinator Node) для всего тома. Если проблема в СХД, перезагрузка одного узла не вернет прямой доступ.
Что такое Block-level и File-level redirection?
Block-level (когда падают MPIO пути) — данные пересылаются блоками по SMB. File-level (когда идет бэкап или chkdsk) — доступ перехватывается на уровне файловой системы (Metadata). Оба варианта логируются событием 5121.