Solución de la comunidad

Recuperar un RAID 1 degradado en ZimaOS: Qué cambió en la versión 1.4.4 y cómo reemplazar un disco averiado

A May-September 2025 RAID 1 recovery thread. In ZimaOS 1.4.1 the UI detected a replacement disk but offered no repair action. IceWhale first handled repair privately and via CLI diagnostics, then announced a comprehensive RAID 1 repair flow for 1.4.4. The official 1.4.4 release notes confirm RAID1 repair was added.

Este hilo documenta una carencia real del producto que posteriormente se convirtió en una función integrada. En ZimaOS 1.4.1, un RAID 1 de dos discos entró en un estado degradado y de solo lectura después de que fallara una unidad de 750 GB. El disco de reemplazo aparecía como un HDD independiente y saludable, pero la interfaz de almacenamiento no ofrecía una acción clara para “reemplazar y reconstruir”.

IceWhale gestionó inicialmente a los usuarios afectados mediante asistencia de ingeniería y diagnósticos de la CLI. Posteriormente, Zima-Giorgio anunció que ZimaOS 1.4.4 ofrecería un proceso más completo de reparación de RAID 1. Las notas de la versión oficial actual de la 1.4.4 confirman que se añadió la reparación de RAID1 para conjuntos degradados o dañados.

El RAID de origen entró en un estado de protección y solo lectura.

Detalle del RAID 1 de ZimaOS que muestra un disco saludable de 750 GB, un disco ausente y el estado Protegiendo, de solo lectura.
ZimaOS protegió el RAID degradado mostrando el miembro ausente y configurando el almacenamiento como de solo lectura.

El HDD de reemplazo se detectó por separado.

Detalle del disco de ZimaOS que muestra el HDD Seagate de reemplazo de 750 GB como saludable y asignado a HDD-Storage independiente.
El problema clave de la versión 1.4.1 no era la detección del disco, sino la ausencia del flujo de reparación que añadiría el reemplazo al RAID degradado.

La página de almacenamiento de la versión 1.4.1 advertía que se necesitaban discos nuevos.

Página de almacenamiento de ZimaOS que muestra MAIN_STORAGE RAID1 en modo de solo lectura, con una advertencia de que se necesitan discos nuevos para la recuperación.
La interfaz sabía que el conjunto necesitaba recuperación, pero en esa versión no mostraba la acción completa de reparación.

IceWhale pidió a los usuarios que evitaran las reparaciones arriesgadas por su cuenta.

Zima-Giorgio ofreció asistencia de ingeniería y pidió a los usuarios experimentados que recopilaran lsblk y mdadm -D /dev/md0 resultado. No publicó un procedimiento destructivo de reconstrucción.

Después de que los ingenieros repararan en privado el conjunto de otro usuario, advirtió explícitamente que no se realizaran operaciones de RAID a nivel raíz sin los conocimientos suficientes o instrucciones directas de los ingenieros.

ZimaOS 1.4.4 añadió la reparación de RAID 1 a la interfaz web.

El 4 de septiembre de 2025, Zima-Giorgio dijo que la versión 1.4.4 ofrecería un proceso más completo de reparación de RAID 1. Cuando otro usuario pidió ayuda con la CLI para la versión 1.4.4, Giorgio respondió que la versión 1.4.4 podía realizar la reparación mediante la interfaz web.

Las notas de la versión actual de IceWhale confirman: «Se añadió la función de reparación de RAID1: la reparación puede realizarse cuando la matriz RAID1 está degradada o dañada.»

Utilice la capacidad oficial de reparación de RAID 1 de ZimaOS 1.4.4 en lugar de reproducir los antiguos experimentos con root/mdadm.

La versión 1.4.4 también corrigió el problema de los discos usados anteriormente durante la recuperación

Las mismas notas de la versión indican que ZimaOS corrigió un problema por el que no se podían seleccionar discos usados anteriormente durante la recuperación de RAID. Esto es directamente relevante para los flujos de trabajo de sustitución de unidades en los que un disco puede contener firmas antiguas o haberse inicializado por separado.

Utilice un disco de reemplazo al menos tan grande como el miembro averiado

Una reconstrucción de RAID 1 necesita un miembro de reemplazo lo bastante grande para el diseño de datos existente de la matriz. Unidades nominalmente idénticas de «750 GB» o «2 TB» pueden diferir ligeramente en el número de sectores, por lo que una unidad con menor capacidad utilizable puede ser rechazada.

Haga una copia de seguridad de los datos legibles antes de una recuperación arriesgada, cuando sea posible

Un RAID 1 degradado ya ha perdido la redundancia. Si el disco restante falla durante la reconstrucción, la matriz puede perderse. Copie los datos irremplazables en una unidad independiente antes de realizar una recuperación invasiva, siempre que la matriz se pueda leer y los datos aún no tengan una copia de seguridad.

No haga clic en «Crear RAID» sobre discos que ya son miembros

Si ZimaOS muestra los miembros antiguos del RAID como discos sin usar o independientes, crear un RAID nuevo puede sobrescribir los metadatos. Antes de continuar, determine si está reparando una matriz existente degradada o creando intencionadamente una matriz nueva y vacía.

Una reconstrucción de RAID 1 es un periodo de alta carga para el disco superviviente

Durante una reconstrucción, ZimaOS debe leer exhaustivamente el miembro superviviente mientras escribe en el reemplazo. Si el disco antiguo restante ya está en estado marginal, esta es una de las ocasiones en que es más probable que revele sectores ilegibles u otros fallos.

Por eso, cuando la matriz degradada aún se puede leer, debe hacerse una copia de seguridad externa de los datos irremplazables antes de iniciar la reconstrucción.

No formate el disco de reemplazo solo porque aparezca como almacenamiento independiente

En el caso de la fuente, el usuario ya había formateado el disco nuevo y ZimaOS lo mostraba como HDD-Storage. Las correcciones posteriores de la versión 1.4.4 abordaron específicamente los discos utilizados anteriormente que no estaban disponibles para la recuperación de RAID.

En un sistema actual, sigue el flujo de reparación de RAID y deja que ZimaOS prepare el reemplazo seleccionado. Formatear o crear primero otro espacio de almacenamiento puede añadir metadatos que la interfaz de recuperación tendrá que gestionar posteriormente.

Los diagnósticos de solo lectura son más seguros que la modificación manual del RAID

Los comandos que solicitó Zima-Giorgio—lsblk y mdadm -D /dev/md0—se utilizaron lecturas de diagnóstico para identificar el dispositivo y el estado del conjunto. Eso es muy diferente de los comandos que añaden miembros, ponen a cero superbloques, fuerzan el ensamblaje o recrean conjuntos.

Si el servicio de asistencia solicita información de la CLI, recopila exactamente los datos de solo lectura solicitados y evita improvisar operaciones destructivas de mdadm a partir de tutoriales de Linux no relacionados.

Verifica el conjunto una vez finalizada la reconstrucción

No consideres completa la recuperación en cuanto se acepte el disco de reemplazo. Espera a que finalice la sincronización o reconstrucción, confirma que el RAID vuelva al estado saludable/de protección, abre archivos representativos y verifica las aplicaciones que dependen del grupo de almacenamiento.

Mantén intacta la copia de seguridad externa hasta que esas comprobaciones hayan finalizado correctamente.

Prepárate para el próximo fallo de disco mientras el conjunto está en buen estado

RAID 1 da tiempo para reemplazar un miembro defectuoso, pero no elimina la necesidad de realizar copias de seguridad. Conserva una copia independiente de los datos importantes, registra los modelos y números de serie de los discos y comprueba periódicamente su estado para detectar una degradación antes de que falle un segundo miembro.

Preguntas frecuentes sobre la recuperación de RAID 1

¿Faltaba la reparación de RAID 1 en la interfaz de ZimaOS 1.4.1?

El usuario de la fuente podía ver el conjunto degradado y el disco de reemplazo, pero no tenía ninguna acción de reparación normal.

¿Añadió IceWhale posteriormente un flujo de reparación en la interfaz web?

Sí. IceWhale indicó que la versión 1.4.4 podía reparar RAID 1 mediante la interfaz web, y las notas de lanzamiento oficiales incluyen la reparación de RAID 1 como una función nueva.

¿Deberían los usuarios actuales ejecutar los comandos mdadm con privilegios de root del hilo antiguo?

No. IceWhale advirtió explícitamente a los usuarios que no realizaran operaciones RAID con privilegios de root, a menos que entendieran los riesgos o recibieran instrucciones de los ingenieros.