Si un RAID5 completamente nuevo alterna entre un disco ausente y todos los discos ausentes, detén la reconstrucción y verifica primero que las tres unidades se detecten de forma constante. Ese patrón apunta más a problemas de alimentación, cableado, placa base/controladora o inestabilidad en la detección de discos que a tres fallos simultáneos del RAID.
El RAID5 actual de ZimaOS requiere al menos tres discos y debería mostrar un miembro fallido como Degradado. Reiniciar repetidamente no solucionará una ruta de disco que desaparece de forma intermitente.
Paso 1: Comprueba todos los discos fuera de la vista del RAID
lsblk -o NAME,SIZE,MODEL,SERIAL,TRAN
dmesg | grep -Ei 'ata|sas|scsi|reset|error|fail' | tail -150
Realiza las comprobaciones después de varios arranques en frío. Los tres discos de 16 TB deberían aparecer siempre con información estable de modelo y número de serie.
Paso 2: Vuelve a conectar las conexiones de alimentación y datos
Apaga completamente el sistema antes de volver a conectar los discos, los cables SATA/SAS, los conectores de la placa posterior o las conexiones de la HBA. Un disco grande de 3,5 pulgadas puede desaparecer durante el arranque si la alimentación es insuficiente.
Paso 3: Comprueba el estado SMART de cada disco
smartctl -x /dev/sdX
Busca autodiagnósticos fallidos, errores de medios, tiempos de espera de comandos, sectores pendientes o errores de interfaz. Un disco nuevo también puede estar defectuoso.
Paso 4: Inspecciona el estado del RAID
La guía de configuración del almacenamiento de ZimaOS actual indica que un miembro fallido debería hacer que la matriz aparezca como Degradada, mientras los datos siguen siendo accesibles.
Los usuarios avanzados también pueden inspeccionar:
cat /proc/mdstat
mdadm --detail /dev/mdX
Usa estos comandos solo si la matriz actual está basada en md y conoces el dispositivo correcto.
No vuelvas a crear el RAID hasta que la detección sea estable
Si todos los discos desaparecen de forma intermitente, la creación limpia de un RAID simplemente volverá a fallar. Corrige primero la ruta de hardware o de la controladora.
El RAID5 requiere tres miembros fiables
La guía de RAID5 de ZimaOS describe RAID5 como un almacenamiento con paridad única que sobrevive al fallo de un miembro. No está diseñado para tolerar una detección inestable de varios discos.
Haz una copia de seguridad antes de reconstruir una matriz existente
Si el grupo ya contiene datos, no lo elimines ni lo vuelvas a crear simplemente porque la interfaz indique que falta un miembro. Protege primero los datos y determina si el disco realmente ha fallado o solo ha desaparecido de la controladora.
Comprueba por separado la lógica de sustitución y reconstrucción
Si un disco específico aparece como fallido de forma constante, sustituye únicamente ese disco y sigue el proceso de reconstrucción de ZimaOS. No inicialices la unidad de sustitución al azar ni la añadas a un grupo nuevo.
La guía de solución de problemas de reconstrucción de RAID ofrece el siguiente paso una vez que la detección sea estable.
Preguntas frecuentes
¿Por qué un RAID5 nuevo indica que falta un disco?
Es posible que un disco se haya desconectado durante la creación o que la alimentación, el cableado, la placa posterior o la controladora no lo detecten de forma fiable.
¿Debería reiniciar repetidamente?
No. En su lugar, realiza comprobaciones de detección repetidas para diagnosticar la ruta de hardware inestable.
¿Puede funcionar RAID5 con dos discos?
No. El RAID5 actual de ZimaOS requiere al menos tres discos.
¿Debería reconstruirlo desde cero si a veces desaparecen todos los discos?
No. Corrige primero la detección de los discos; de lo contrario, la nueva matriz podría fallar de la misma manera.
