Un RAID5 affichant « Protection » n’est pas automatiquement bloqué ou en cours de reconstruction. Dans le cas présenté, /proc/mdstat indiquait que les quatre membres étaient présents sous la forme [UUUU], tandis que sync_action renvoyait idle et array_state renvoyait clean. Il s’agit d’un état mdraid sain.
L’étiquette « Protection » peut donc correspondre à une présentation par ZimaOS de l’état de protection ou de parité, plutôt qu’à la preuve d’une reconstruction active. Vérifiez l’état sous-jacent de la grappe avant de l’interrompre.
Lisez d’abord /proc/mdstat
cat /proc/mdstat
Pour un RAID5 à quatre disques, [UUUU] signifie que les quatre emplacements de membres prévus sont actifs. Un tiret bas manquant, comme dans [UU_U], indique qu’un membre est manquant ou défaillant.
Vérifiez si une synchronisation est en cours
cat /sys/block/md0/md/sync_action
L’utilisateur a obtenu idle, ce qui confirmait qu’aucune resynchronisation, récupération ou vérification active n’était en cours à ce moment-là.
Vérifiez l’état de la grappe md
cat /sys/block/md0/md/array_state
clean signifie que md considère la grappe comme cohérente et non modifiée.
Comprenez le bitmap d’intention d’écriture
La sortie présentée affichait un bitmap. Un bitmap d’intention d’écriture suit les régions modifiées lorsque la grappe est active et peut réduire le travail de récupération après un arrêt incorrect. Sa présence n’est pas une erreur en soi.
Comparez avec le comportement RAID actuel de ZimaOS
Le guide RAID de ZimaOS actuel indique que le RAID5 active automatiquement la parité et que l’initialisation peut se poursuivre tandis que la grappe reste utilisable.
Quand « Protection » nécessite une vérification
Effectuez des vérifications si /proc/mdstat affiche une reconstruction ou une resynchronisation, si un ou plusieurs membres sont manquants, si des erreurs d’E/S se répètent, si l’interface affiche l’état Dégradé, ou si array_state n’est pas à clean alors qu’il devrait l’être.
N’arrêtez pas la grappe simplement pour supprimer l’étiquette
Si la grappe est propre, inactive et complète, l’arrêt de mdraid peut créer un risque inutile. L’état « Protection » ne justifie pas de recréer le pool.
Sauvegardez vos données, même lorsque le RAID est sain
Le RAID5 protège contre la défaillance d’un seul disque, mais pas contre la suppression de données, les logiciels malveillants, la défaillance du contrôleur ou les sinistres. Conservez une sauvegarde indépendante.
Le guide de planification des sauvegardes présente cette seconde couche de protection.
« Protection » peut apparaître après la création ou l’extension
La grappe présentée avait été créée récemment, puis remplie de plusieurs téraoctets de données. ZimaOS peut conserver une étiquette d’état axée sur la protection même lorsque mdraid n’indique plus aucune synchronisation active. L’état md de bas niveau constitue donc un indicateur de diagnostic plus fiable.
Recherchez les erreurs d’E/S masquées
dmesg | grep -Ei 'md0|nvme|error|timeout|reset' | tail -100
Si la grappe est propre, mais que le noyau journalise des réinitialisations NVMe ou des erreurs d’E/S répétées, examinez le disque concerné ou le chemin PCIe au lieu de considérer l’état comme purement esthétique.
Conservez une référence d’un état sain
Enregistrez une copie de /proc/mdstat, de array_state et des numéros de série des membres lorsque la grappe est saine. Si elle devient ultérieurement Dégradée, vous disposerez d’une référence connue pour la comparaison.
FAQ
« Protection » signifie-t-il que le RAID est en reconstruction ?
Pas nécessairement. Dans le cas présenté, sync_action était à idle et la grappe était à l’état clean.
Que signifie [UUUU] ?
Les quatre membres mdraid prévus sont actifs.
Dois-je attendre avant de copier des données ?
Si une initialisation ou une resynchronisation est réellement en cours, les performances peuvent être réduites ; consultez /proc/mdstat plutôt que de vous fier uniquement à l’étiquette.
Quand un RAID5 est-il en mauvais état ?
Des membres manquants, un état Dégradé, des erreurs d’E/S, des diagnostics SMART en échec ou une récupération active après une déconnexion inattendue nécessitent une intervention.
