Solución de la comunidad

Disco ausente en RAID 5 de ZimaOS en una configuración nueva: qué comprobar

A new three-disk RAID5 alternated between one missing disk and all disks missing, suggesting unstable drive detection rather than a normal single-disk failure.

Si un RAID5 completamente nuevo alterna entre un disco ausente y todos los discos ausentes, detén la reconstrucción y verifica primero que las tres unidades se detecten de forma constante. Ese patrón apunta más a problemas de alimentación, cableado, placa base/controladora o inestabilidad en la detección de discos que a tres fallos simultáneos del RAID.

El RAID5 actual de ZimaOS requiere al menos tres discos y debería mostrar un miembro fallido como Degradado. Reiniciar repetidamente no solucionará una ruta de disco que desaparece de forma intermitente.

Paso 1: Comprueba todos los discos fuera de la vista del RAID

lsblk -o NAME,SIZE,MODEL,SERIAL,TRAN
dmesg | grep -Ei 'ata|sas|scsi|reset|error|fail' | tail -150

Realiza las comprobaciones después de varios arranques en frío. Los tres discos de 16 TB deberían aparecer siempre con información estable de modelo y número de serie.

Paso 2: Vuelve a conectar las conexiones de alimentación y datos

Apaga completamente el sistema antes de volver a conectar los discos, los cables SATA/SAS, los conectores de la placa posterior o las conexiones de la HBA. Un disco grande de 3,5 pulgadas puede desaparecer durante el arranque si la alimentación es insuficiente.

Paso 3: Comprueba el estado SMART de cada disco

smartctl -x /dev/sdX

Busca autodiagnósticos fallidos, errores de medios, tiempos de espera de comandos, sectores pendientes o errores de interfaz. Un disco nuevo también puede estar defectuoso.

Paso 4: Inspecciona el estado del RAID

La guía de configuración del almacenamiento de ZimaOS actual indica que un miembro fallido debería hacer que la matriz aparezca como Degradada, mientras los datos siguen siendo accesibles.

Los usuarios avanzados también pueden inspeccionar:

cat /proc/mdstat
mdadm --detail /dev/mdX

Usa estos comandos solo si la matriz actual está basada en md y conoces el dispositivo correcto.

No vuelvas a crear el RAID hasta que la detección sea estable

Si todos los discos desaparecen de forma intermitente, la creación limpia de un RAID simplemente volverá a fallar. Corrige primero la ruta de hardware o de la controladora.

El RAID5 requiere tres miembros fiables

La guía de RAID5 de ZimaOS describe RAID5 como un almacenamiento con paridad única que sobrevive al fallo de un miembro. No está diseñado para tolerar una detección inestable de varios discos.

Haz una copia de seguridad antes de reconstruir una matriz existente

Si el grupo ya contiene datos, no lo elimines ni lo vuelvas a crear simplemente porque la interfaz indique que falta un miembro. Protege primero los datos y determina si el disco realmente ha fallado o solo ha desaparecido de la controladora.

Comprueba por separado la lógica de sustitución y reconstrucción

Si un disco específico aparece como fallido de forma constante, sustituye únicamente ese disco y sigue el proceso de reconstrucción de ZimaOS. No inicialices la unidad de sustitución al azar ni la añadas a un grupo nuevo.

La guía de solución de problemas de reconstrucción de RAID ofrece el siguiente paso una vez que la detección sea estable.

Preguntas frecuentes

¿Por qué un RAID5 nuevo indica que falta un disco?

Es posible que un disco se haya desconectado durante la creación o que la alimentación, el cableado, la placa posterior o la controladora no lo detecten de forma fiable.

¿Debería reiniciar repetidamente?

No. En su lugar, realiza comprobaciones de detección repetidas para diagnosticar la ruta de hardware inestable.

¿Puede funcionar RAID5 con dos discos?

No. El RAID5 actual de ZimaOS requiere al menos tres discos.

¿Debería reconstruirlo desde cero si a veces desaparecen todos los discos?

No. Corrige primero la detección de los discos; de lo contrario, la nueva matriz podría fallar de la misma manera.