Solución de la comunidad

¿Funciona la recuperación RAID de ZimaOS? Qué significó el fallo de 2024

A ZimaCube owner deliberately broke a RAID5 to test drive replacement and found that the 1.2.1 recovery UI could not accept the replacement disk.

Respuesta actual: Sí, existe la recuperación de RAID, pero este fallo de 2024 ocurrió mientras el reemplazo estaba desactivado

La prueba fallida es históricamente real. En ZimaOS 1.2.1, IceWhale indicó explícitamente que el reemplazo de RAID se había desactivado debido a un problema de verificación. Por lo tanto, el cuadro de diálogo de recuperación vacío no demostraba que la recuperación de RAID nunca pudiera funcionar; era una función desactivada específica de esa versión.

Página de almacenamiento de ZimaOS que muestra un RAID degradado en modo de solo lectura y solicita una unidad de reemplazo
La prueba de 2024 retiró y reformateó intencionadamente un miembro del RAID5. ZimaOS bloqueó el conjunto degradado en modo de solo lectura y solicitó una unidad de reemplazo.
Cuadro de diálogo de recuperación de RAID de ZimaOS que muestra que no hay discos duros disponibles para la prueba de reemplazo fallida
El cuadro de diálogo de recuperación de RAID no pudo ofrecer el disco vuelto a insertar en ZimaOS 1.2.1, lo que coincidía con la declaración posterior de IceWhale de que el reemplazo se había desactivado temporalmente.

No vuelvas a crear ni formatees un RAID cuando los datos aún sean importantes

Las prácticas actuales de recuperación son mucho más conservadoras. Si un conjunto existente deja de reconocerse después de reinstalar el sistema o perder la base de datos de almacenamiento, conserva los discos miembros y recupera la configuración de RAID almacenada antes de crear un conjunto nuevo. La recuperación de RAID de ZimaOS explica el método actual basado en local-storage.db y el límite de la alternativa destructiva.

La inspección de conjuntos md con mdadm de Linux es la referencia original para identificar un conjunto md.

Una prueba de reemplazo fallida y una actualización fallida eran dos problemas distintos

Pantalla de configuración general de ZimaOS 1.2.0 sin la notificación de actualización esperada
La pantalla 1.2.0 de otro usuario no mostraba el aviso de actualización esperado; posteriormente, el hilo atribuyó ese problema concreto a que el firewall bloqueaba el tráfico de descarga.

Más adelante, el hilo incluyó un sistema 1.2.0 que no podía ver la actualización. El caso resultó estar relacionado con el firewall: la descarga de la actualización estaba bloqueada. No mezcles una actualización de software no disponible con el fallo de reemplazo del miembro del RAID solo porque ambos aparecieron en la misma conversación.

Prueba la recuperación con datos que puedas perder

La idea original era buena: verificar el modo degradado y el comportamiento del reemplazo antes de confiar datos importantes a un conjunto. Usa archivos de prueba desechables, retira un miembro correctamente, confirma que el conjunto pase a estar degradado y en modo de solo lectura como se espera, añade un disco de reemplazo conocido y supervisa el estado de la reconstrucción.

El comportamiento de Linux MD del kernel proporciona el modelo de nivel inferior.

La recuperación de RAID no es una copia de seguridad

Una reconstrucción de RAID correcta protege frente al fallo de un disco miembro. No protege frente a eliminaciones accidentales, corrupción del sistema de archivos, malware, errores del controlador ni la creación de un conjunto nuevo sobre los discos equivocados. Conserva una segunda copia verificada fuera del conjunto.

Para el hardware actual con varias unidades y la planificación de la recuperación, el almacenamiento ZimaCube 2 proporciona el contexto actual de la plataforma.