Ein RAID5 mit der Anzeige „Protecting“ ist nicht automatisch hängen geblieben oder wird gerade neu aufgebaut. Im Ausgangsfall zeigte /proc/mdstat, dass alle vier Mitglieder als [UUUU] vorhanden waren, während sync_action den Wert idle und array_state den Wert clean zurückgab. Das ist ein gesunder mdraid-Zustand.
Die Bezeichnung „Protecting“ kann daher eine Darstellung des Schutz- oder Paritätsstatus durch ZimaOS sein und kein Hinweis auf einen aktiven Wiederaufbau. Überprüfen Sie das zugrunde liegende Array, bevor Sie den Vorgang unterbrechen.
Zuerst /proc/mdstat auslesen
cat /proc/mdstat
Bei einem RAID5 mit vier Festplatten bedeutet [UUUU], dass alle vier erwarteten Mitgliedsplätze aktiv sind. Ein fehlender Unterstrich wie bei [UU_U] weist auf ein fehlendes oder ausgefallenes Mitglied hin.
Prüfen, ob eine Synchronisierung läuft
cat /sys/block/md0/md/sync_action
Der Benutzer im Ausgangsfall erhielt idle. Damit war zu diesem Zeitpunkt keine aktive Neusynchronisierung, Wiederherstellung oder Prüfung im Gange.
Den Zustand des md-Arrays prüfen
cat /sys/block/md0/md/array_state
clean bedeutet, dass md das Array als konsistent und nicht als geändert betrachtet.
Die Write-Intent-Bitmap verstehen
Die Ausgabe im Ausgangsfall zeigte eine Bitmap. Eine Write-Intent-Bitmap protokolliert Bereiche, die während des Betriebs des Arrays geändert wurden, und kann den Wiederherstellungsaufwand nach einem unsauberen Herunterfahren reduzieren. Ihr Vorhandensein ist selbst kein Fehler.
Das aktuelle RAID-Verhalten von ZimaOS vergleichen
Der aktuelle ZimaOS-RAID-Leitfaden erklärt, dass RAID5 die Parität automatisch aktiviert und die Initialisierung fortgesetzt werden kann, während das Array weiterhin nutzbar bleibt.
Wann „Protecting“ untersucht werden sollte
Untersuchen Sie den Zustand, wenn /proc/mdstat einen Wiederaufbau oder eine Neusynchronisierung anzeigt, ein oder mehrere Mitglieder fehlen, wiederholt E/A-Fehler auftreten, die Benutzeroberfläche den Status „Degraded“ anzeigt oder array_state nicht clean ist, obwohl Sie dies erwarten.
Das Array nicht nur zum Entfernen der Anzeige stoppen
Wenn das Array sauber, im Leerlauf und vollständig ist, kann das Stoppen von mdraid ein unnötiges Risiko darstellen. „Protecting“ ist kein Grund, den Pool neu zu erstellen.
Auch bei einem gesunden RAID ein Backup erstellen
RAID5 schützt vor dem Ausfall einer Festplatte, nicht jedoch vor dem Löschen von Daten, Malware, einem Controllerausfall oder einer Katastrophe. Bewahren Sie ein unabhängiges Backup auf.
Der Leitfaden zur Backup-Planung behandelt diese zweite Schutzebene.
„Protecting“ kann nach der Erstellung oder Erweiterung erscheinen
Das Array im Ausgangsfall war erst kurz zuvor erstellt und anschließend mit mehreren Terabytes an Daten gefüllt worden. ZimaOS kann eine schutzorientierte Statusbezeichnung beibehalten, auch wenn mdraid selbst keine aktive Synchronisierung meldet. Der md-Status auf niedriger Ebene ist daher das aussagekräftigere Diagnosesignal.
Auf versteckte E/A-Fehler prüfen
dmesg | grep -Ei 'md0|nvme|error|timeout|reset' | tail -100
Wenn das Array sauber ist, der Kernel jedoch wiederholte NVMe-Resets oder E/A-Fehler protokolliert, sollten Sie das betroffene Laufwerk oder den PCIe-Pfad untersuchen, anstatt den Status einfach als kosmetisch abzutun.
Eine gesunde Ausgangsbasis dokumentieren
Speichern Sie eine Kopie von /proc/mdstat, array_state und den Seriennummern der Mitglieder, solange das Array gesund ist. Falls es später den Status „Degraded“ annimmt, haben Sie eine bekannte funktionierende Referenz zum Vergleich.
FAQ
Bedeutet „Protecting“, dass das RAID neu aufgebaut wird?
Nicht unbedingt. Im Ausgangsfall war sync_action im Leerlauf und das Array sauber.
Was bedeutet [UUUU]?
Alle vier erwarteten mdraid-Mitglieder sind aktiv.
Sollte ich vor dem Kopieren von Daten warten?
Wenn tatsächlich eine Initialisierung oder Neusynchronisierung läuft, kann die Leistung reduziert sein. Prüfen Sie /proc/mdstat statt nur auf die Anzeige zu vertrauen.
Wann ist RAID5 nicht gesund?
Fehlende Mitglieder, der Status „Degraded“, E/A-Fehler, fehlgeschlagene SMART-Diagnosen oder eine aktive Wiederherstellung nach einem unerwarteten Verbindungsabbruch müssen untersucht werden.
