Solución de la comunidad

Estado de salida 2 de RAID en ZimaOS: reinicia antes de borrar los discos

Two new 4 TB disks worked individually but RAID creation returned exit status 2 until ZimaOS was rebooted after disk deactivation.

Conclusión: Reinicia después de desactivar los discos antes de empezar a borrar los metadatos

En el caso resuelto, dos discos duros nuevos de 4 TB funcionaban como discos independientes, pero la creación de RAID 0/1 devolvía un exit status 2 genérico. No fue necesario reemplazar ni borrar ningún disco: reiniciar ZimaOS después de desactivar las unidades eliminó el estado de almacenamiento obsoleto y la creación del RAID se realizó correctamente. Esta debería ser la primera prueba de bajo riesgo.

Confirma que ambos discos estén realmente libres

lsblk -f
mount
cat /proc/mdstat

Ambas unidades candidatas deben estar desmontadas y no ser ya miembros de otra matriz md ni de un pool activo de ZimaOS. No lo deduzcas únicamente de la etiqueta de la interfaz si la creación ya falló.

Reinicia una vez antes de realizar una limpieza destructiva

Desactiva las dos unidades en Almacenamiento, reinicia ZimaOS, vuelve a Almacenamiento y crea el RAID de nuevo. Esto resulta especialmente útil cuando la interfaz o el servicio de almacenamiento aún pueden conservar un estado obsoleto de la configuración independiente anterior.

Si sigue fallando, captura el error real

journalctl -xb | tail -200
dmesg | tail -200

exit status 2 es solo un mensaje envoltorio. La causa útil puede estar relacionada con el estado de mdadm, firmas de sistemas de archivos obsoletas, un conflicto de montaje u otro fallo del servicio de almacenamiento. El comportamiento de RAID de mdadm en Linux explica la capa de la matriz.

Inspecciona los metadatos antes de borrarlos

sudo wipefs -n /dev/sdX
sudo mdadm --examine /dev/sdX 2>/dev/null

Usa primero el modo de inspección. Si después eliminas firmas, asegúrate de que los discos no contengan datos que necesites. No conviertas “wipefs -a everything” en la respuesta predeterminada ante un error genérico de la interfaz.

Las versiones actuales de ZimaOS admiten RAID 0 y RAID 1 directamente

La documentación actual de almacenamiento incluye RAID 0, RAID 1, RAID 5, RAID 6 y JBOD. RAID 0 requiere al menos dos discos y no ofrece redundancia; RAID 1 replica los datos en dos discos. Los niveles de RAID de ZimaOS constituyen la referencia actual del producto.

No uses RAID 0 para datos que no puedas recrear

RAID 0 aumenta la capacidad utilizable y puede mejorar el rendimiento, pero el fallo de un solo miembro destruye la matriz. Si estos discos de 4 TB contienen archivos multimedia o copias de seguridad que te importan, evalúa si RAID 1/5 más una copia de seguridad independiente sería más adecuado.

La copia de seguridad de ZimaOS y la recuperación de RAID explican el modelo de fallos.

Verifica la nueva matriz antes de cargar datos

cat /proc/mdstat
lsblk -f
df -h

Espera a que finalicen las tareas de inicialización o resincronización y, después, copia primero datos de prueba prescindibles. Reinicia una vez y verifica que la matriz vuelva a mostrarse en buen estado antes de confiarle la única copia de archivos importantes.

La diferencia de tamaño entre discos no debe ser la primera conclusión

Pequeñas diferencias nominales pueden afectar al tamaño utilizable, pero en este caso el reinicio resolvió el problema por sí solo. Diagnostica los registros reales antes de atribuir un código de estado genérico a una diferencia entre unidades o a un fallo de hardware.

Si los metadatos son realmente el problema, elimina solo lo que hayas identificado

Las comprobaciones de firmas de wipefs en Linux pueden mostrar firmas de sistemas de archivos, tablas de particiones y RAID antes de borrar nada. Si confirmas que los discos están vacíos y los registros apuntan a firmas obsoletas, elimina deliberadamente los metadatos específicos, reinicia y vuelve a intentarlo. Esto es más seguro que tratar cualquier error genérico de RAID como permiso para borrar inmediatamente ambas unidades.

Después de la limpieza, vuelve a ejecutar lsblk -f y mdadm --examine para confirmar que las unidades se encuentran realmente en el estado que ZimaOS espera antes de abrir de nuevo el flujo de creación del RAID.

Si el reinicio permite crear la matriz de inmediato, registra ese resultado en las notas del incidente. Es una evidencia útil de que no se demostró que los discos fueran defectuosos y de que el estado obsoleto del servicio era la explicación más probable.

Preguntas frecuentes

¿Qué significa exit status 2 al crear un RAID en ZimaOS?

Es un resultado de fallo genérico, no un diagnóstico. Revisa los registros para encontrar el error subyacente del almacenamiento o de mdadm.

¿Debo borrar las unidades inmediatamente?

No. Primero reinicia después de desactivarlas y, después, inspecciona los metadatos antes de realizar una limpieza destructiva.

¿Pueden las unidades nuevas tener metadatos antiguos?

Sí, especialmente si se probaron o particionaron anteriormente, pero compruébalo con wipefs -n o mdadm --examine.

¿Es seguro usar RAID 0 para copias de seguridad?

No. Si se pierde un miembro, se pierde la matriz, así que conserva copias independientes.

¿Cómo sé si el RAID se creó correctamente?

Comprueba /proc/mdstat y el estado del sistema de archivos y los montajes, reinicia y verifica que la matriz siga en buen estado.