Solution communautaire

Récupérer un RAID 5 ZimaOS après la défaillance d’un disque : remplacer le disque, suivre l’invite de reconstruction et vérifier la matrice

A May 2025 ZimaCube case where one disk in a four-drive 12 TB RAID5 was marked Damaged. The user powered down, replaced the failed disk, powered up, followed the ZimaOS prompts, and reported that the array immediately began an estimated 13.5-hour recovery.

La récupération décrite par la source a été simple et vérifiée par l’utilisateur : un RAID 5 à quatre disques signalait un disque comme Endommagé. Le propriétaire a éteint le ZimaCube, remplacé ce disque, rallumé le système, suivi les invites de stockage de ZimaOS et indiqué que la reconstruction avait commencé, avec une durée restante estimée à 13,5 heures.

La documentation actuelle de ZimaOS décrit désormais plus explicitement ce même processus géré : lorsqu’un disque RAID tombe en panne, la grappe passe en état dégradé, les données restent accessibles et, après remplacement du disque défaillant, ZimaOS guide l’utilisateur tout au long de la reconstruction. L’ancienne source indiquait également qu’une autre grappe RAID 0 était passée en lecture seule au même moment ; la documentation actuelle ne présente pas cela comme un comportement permanent normal pour toutes les autres grappes.

Confirmer quel disque physique est réellement défaillant

Avant de retirer quoi que ce soit, faites correspondre l’état du stockage dans ZimaOS avec la baie physique et le numéro de série. Dans un RAID 5 dégradé, retirer le mauvais membre fonctionnel peut transformer une panne d’un seul disque en une interruption beaucoup plus grave touchant plusieurs disques.

Copier les données critiques avant la reconstruction si la grappe reste accessible

Un RAID 5 survit à la panne d’un membre, mais la reconstruction sollicite fortement tous les disques encore fonctionnels. Si un autre disque présente un état SMART préoccupant ou des secteurs illisibles, c’est pendant la reconstruction que ces faiblesses risquent le plus de se manifester.

Si la grappe est accessible et que les données sont irremplaçables, copiez les fichiers les plus importants vers un stockage indépendant avant de lancer une longue reconstruction, lorsque cela est possible.

La source a remplacé le disque hors tension

L’auteur du message a éteint le ZimaCube avant de remplacer le disque endommagé. Il s’agit du choix par défaut le plus sûr lorsque vous ne vous appuyez pas explicitement sur un processus de remplacement à chaud documenté.

Après avoir installé le disque de remplacement, allumez le système et laissez ZimaOS détecter la grappe dégradée ainsi que le nouveau disque éligible.

Utiliser l’invite de reconstruction de ZimaOS

L’utilisateur de la source n’a pas publié de commande de réparation mdadm manuelle. Il a suivi les invites de l’interface de stockage, et la reconstruction a démarré avec succès.

Les recommandations actuelles d’IceWhale concernant le stockage indiquent la même chose : remplacez le disque défaillant et laissez ZimaOS vous guider tout au long de la reconstruction.

Utilisez le processus actuel de récupération du stockage de ZimaOS.

Utiliser un disque de remplacement de capacité égale ou supérieure

Un disque de remplacement doit être suffisamment grand pour respecter la géométrie des membres du RAID. Deux disques annoncés avec la même capacité nominale peuvent présenter de légères différences au niveau du nombre de secteurs utilisables ; lorsque cela est possible, choisir un modèle de capacité identique réduit les risques de mauvaise surprise.

Surveiller la progression de la reconstruction et l’état des disques

ZimaOS 1.3.2 et les versions ultérieures affichent plus clairement la progression des opérations de reconstruction et de calcul de parité RAID. Pendant la reconstruction, évitez les arrêts inutiles, surveillez les températures et l’état SMART, et réduisez autant que possible les charges importantes.

Vérifier la grappe après la récupération

Une fois la reconstruction terminée, vérifiez que :

  • l’état du RAID est de nouveau sain ;
  • tous les membres attendus sont actifs ;
  • les partages et les applications peuvent lire et écrire normalement ;
  • les fichiers importants s’ouvrent correctement ;
  • votre sauvegarde indépendante est à jour.

Le passage en lecture seule du second RAID 0 de la source était un symptôme distinct

L’utilisateur a indiqué que les deux grappes étaient passées en lecture seule, alors que seul le RAID 5 avait un disque endommagé. La discussion ne précisait pas pourquoi le RAID 0 indépendant avait été protégé de cette manière ni quelle action exacte avait rétabli son accès en écriture.

Ne supposez pas qu’un système ZimaOS actuel passera toujours toutes les grappes en lecture seule après une seule panne RAID.

FAQ sur la récupération d’un RAID 5

L’utilisateur de la source a-t-il réussi à démarrer la reconstruction du RAID 5 ?

Oui. Après avoir remplacé le disque défaillant et suivi les invites, la grappe est passée en récupération, avec une durée estimée d’environ 13,5 heures.

Dois-je exécuter manuellement des commandes mdadm au préalable ?

Pas dans le cadre du processus confirmé par la source. Utilisez le processus de reconstruction géré de ZimaOS, sauf si l’assistance IceWhale vous fournit des instructions en ligne de commande spécifiques à votre version.

Le RAID 5 constitue-t-il une sauvegarde ?

Non. Le RAID préserve la disponibilité en cas de panne d’un disque ; il ne protège pas contre une suppression accidentelle, une corruption, un vol ou une autre panne pendant la reconstruction.