Solution communautaire

Disque manquant dans un RAID5 ZimaOS lors d’une nouvelle configuration : que vérifier

A new three-disk RAID5 alternated between one missing disk and all disks missing, suggesting unstable drive detection rather than a normal single-disk failure.

Si un RAID5 flambant neuf alterne entre un disque manquant et l’absence de tous les disques, arrêtez la reconstruction et vérifiez d’abord que les trois disques sont détectés de manière stable. Ce comportement indique davantage un problème d’alimentation, de câblage, de fond de panier/contrôleur ou d’instabilité de détection des disques que trois pannes RAID simultanées.

Le RAID5 actuel de ZimaOS nécessite au moins trois disques et doit signaler un membre défaillant comme étant dégradé. Redémarrer à répétition ne corrige pas un chemin de disque qui disparaît par intermittence.

Étape 1 : Vérifier chaque disque en dehors de la vue RAID

lsblk -o NAME,SIZE,MODEL,SERIAL,TRAN
dmesg | grep -Ei 'ata|sas|scsi|reset|error|fail' | tail -150

Effectuez ces vérifications après plusieurs démarrages à froid. Les trois disques de 16 To doivent apparaître à chaque fois, avec des informations de modèle et de numéro de série stables.

Étape 2 : Rebrancher les connexions d’alimentation et de données

Éteignez complètement le système avant de rebrancher les disques, les câbles SATA/SAS, les connecteurs du fond de panier ou les connexions HBA. Un gros disque de 3,5 pouces peut disparaître pendant sa montée en régime lorsque l’alimentation est insuffisante.

Étape 3 : Vérifier l’état SMART de chaque disque

smartctl -x /dev/sdX

Recherchez les autotests échoués, les erreurs de support, les délais d’expiration des commandes, les secteurs en attente ou les erreurs d’interface. Un disque neuf peut tout de même être défectueux.

Étape 4 : Examiner l’état du RAID

Le guide actuel de configuration du stockage de ZimaOS indique qu’un membre défaillant doit faire passer la matrice à l’état dégradé, tandis que les données restent accessibles.

Les utilisateurs avancés peuvent également examiner :

cat /proc/mdstat
mdadm --detail /dev/mdX

Utilisez ces commandes uniquement si la matrice actuelle repose sur md et si vous connaissez le périphérique correct.

Ne recréez pas le RAID tant que la détection n’est pas stable

Si tous les disques disparaissent par intermittence, une création propre du RAID échouera simplement à nouveau. Corrigez d’abord le chemin matériel ou celui du contrôleur.

Le RAID5 nécessite trois membres fiables

Le guide actuel du RAID5 de ZimaOS décrit le RAID5 comme un stockage à parité simple qui résiste à la défaillance d’un membre. Il n’est pas conçu pour tolérer une détection instable de plusieurs disques.

Sauvegardez vos données avant de reconstruire une matrice existante

Si le pool contient déjà des données, ne le supprimez pas et ne le recréez pas simplement parce que l’interface indique qu’un membre est manquant. Protégez d’abord les données et déterminez si le disque est réellement défaillant ou s’il a seulement disparu du contrôleur.

Vérifiez séparément la logique de remplacement et de reconstruction

Si un disque précis est constamment signalé comme défaillant, remplacez uniquement ce disque et suivez la procédure de reconstruction de ZimaOS. N’initialisez pas le disque de remplacement au hasard et ne l’ajoutez pas à un nouveau pool.

Le guide de dépannage de la reconstruction RAID présente l’étape suivante une fois la détection stabilisée.

FAQ

Pourquoi un RAID5 neuf indique-t-il « Disque manquant » ?

Un disque peut s’être déconnecté pendant la création ou ne pas être détecté de manière fiable en raison de l’alimentation, du câblage, du fond de panier ou du contrôleur.

Dois-je redémarrer à répétition ?

Non. Effectuez plutôt des vérifications répétées de la détection afin de diagnostiquer le chemin matériel instable.

Le RAID5 peut-il fonctionner avec deux disques ?

Non. Le RAID5 actuel de ZimaOS nécessite au moins trois disques.

Dois-je reconstruire proprement le RAID si tous les disques disparaissent parfois ?

Non. Corrigez d’abord la détection des disques ; sinon, la nouvelle matrice risque de subir la même défaillance.