Rozwiązanie społecznościowe

ZimaOS — kod zakończenia RAID 2: uruchom ponownie przed wymazaniem dysków

Two new 4 TB disks worked individually but RAID creation returned exit status 2 until ZimaOS was rebooted after disk deactivation.

Podsumowanie: uruchom ponownie system po dezaktywacji dysków, zanim zaczniesz usuwać metadane

W opisanym przypadku dwa nowe dyski HDD o pojemności 4 TB działały jako dyski niezależne, ale podczas tworzenia macierzy RAID 0/1 pojawiał się ogólny komunikat exit status 2. Nie była potrzebna wymiana ani wymazywanie dysków: ponowne uruchomienie ZimaOS po dezaktywacji dysków usunęło nieaktualny stan pamięci masowej i umożliwiło pomyślne utworzenie macierzy RAID. To powinien być pierwszy test o niskim ryzyku.

Potwierdź, że oba dyski są rzeczywiście wolne

lsblk -f
mount
cat /proc/mdstat

Oba dyski powinny być odmontowane i nie powinny już należeć do innej macierzy md ani aktywnej puli ZimaOS. Jeśli tworzenie macierzy już się nie powiodło, nie wyciągaj takiego wniosku wyłącznie na podstawie etykiety w interfejsie.

Uruchom system ponownie przed rozpoczęciem destrukcyjnego czyszczenia

Dezaktywuj oba dyski w sekcji Pamięć, uruchom ponownie ZimaOS, wróć do sekcji Pamięć, a następnie ponownie utwórz macierz RAID. Jest to szczególnie przydatne, gdy interfejs lub usługa pamięci masowej nadal przechowuje nieaktualny stan po wcześniejszej konfiguracji dysków niezależnych.

Jeśli problem nadal występuje, przechwyć rzeczywisty błąd

journalctl -xb | tail -200
dmesg | tail -200

exit status 2 to tylko komunikat opakowujący. Rzeczywista przyczyna może dotyczyć stanu mdadm, nieaktualnych sygnatur systemu plików, konfliktu montowania lub innej awarii usługi pamięci masowej. Dokumentacja systemu Linux dotycząca działania macierzy RAID mdadm wyjaśnia warstwę macierzy.

Sprawdź metadane przed ich usunięciem

sudo wipefs -n /dev/sdX
sudo mdadm --examine /dev/sdX 2>/dev/null

Najpierw użyj trybu inspekcji. Jeśli później usuniesz sygnatury, upewnij się, że na dyskach nie ma potrzebnych danych. Nie traktuj polecenia „wipefs -a everything” jako domyślnego rozwiązania ogólnego błędu interfejsu.

Obecna wersja ZimaOS obsługuje bezpośrednio RAID 0 i RAID 1

Aktualna dokumentacja pamięci masowej obejmuje RAID 0, RAID 1, RAID 5, RAID 6 i JBOD. RAID 0 wymaga co najmniej dwóch dysków i nie zapewnia nadmiarowości; RAID 1 tworzy kopię lustrzaną dwóch dysków. Dokumentacja poziomów RAID w ZimaOS jest aktualnym źródłem informacji o produkcie.

Nie używaj RAID 0 do danych, których nie możesz odtworzyć

RAID 0 zwiększa dostępną pojemność i może poprawić przepustowość, ale awaria jednego członka niszczy całą macierz. Jeśli na tych dyskach 4 TB znajdują się ważne multimedia lub kopie zapasowe, rozważ, czy RAID 1/5 wraz z niezależną kopią zapasową nie będzie odpowiedniejszy.

Informacje o kopii zapasowej ZimaOS i odzyskiwaniu RAID opisują model awarii.

Zweryfikuj nową macierz przed zapisaniem danych

cat /proc/mdstat
lsblk -f
df -h

Poczekaj na zakończenie inicjalizacji lub ponownej synchronizacji, a następnie najpierw skopiuj testowe dane, których utrata nie będzie problemem. Uruchom system ponownie i sprawdź, czy macierz nadal działa prawidłowo, zanim zapiszesz jedyną kopię ważnych plików.

Niezgodność rozmiaru dysków nie jest pierwszym wnioskiem

Niewielkie różnice w nominalnej pojemności mogą wpływać na dostępną przestrzeń, ale w tym przypadku problem rozwiązało samo ponowne uruchomienie systemu. Przed przypisaniem ogólnego kodu błędu różnicom między dyskami lub awarii sprzętu przeanalizuj rzeczywiste logi.

Jeśli problemem rzeczywiście są metadane, usuń tylko te, które zostały zidentyfikowane

Narzędzie systemu Linux do sprawdzania sygnatur wipefs może wyświetlić sygnatury systemu plików, tablicy partycji i RAID, zanim cokolwiek zostanie usunięte. Jeśli potwierdzono, że dyski są puste, a logi wskazują na nieaktualne sygnatury, celowo usuń konkretne metadane, uruchom system ponownie i spróbuj ponownie. Jest to bezpieczniejsze niż traktowanie każdego ogólnego błędu RAID jako pozwolenia na natychmiastowe wymazanie obu dysków.

Po wyczyszczeniu ponownie uruchom lsblk -f i mdadm --examine, aby upewnić się, że dyski rzeczywiście są w stanie oczekiwanym przez ZimaOS, zanim ponownie otworzysz proces tworzenia macierzy RAID.

Jeśli ponowne uruchomienie systemu natychmiast rozwiąże problem z tworzeniem macierzy, odnotuj ten wynik w raporcie incydentu. Jest to przydatny dowód na to, że nie potwierdzono awarii samych dysków, a bardziej prawdopodobnym wyjaśnieniem był nieaktualny stan usługi.

FAQ

Co oznacza „exit status 2” podczas tworzenia macierzy RAID w ZimaOS?

To ogólny wynik niepowodzenia, a nie diagnoza. Sprawdź logi, aby znaleźć przyczynę związaną z pamięcią masową lub mdadm.

Czy powinienem natychmiast wymazać dyski?

Nie. Najpierw po dezaktywacji uruchom system ponownie, a następnie sprawdź metadane przed rozpoczęciem destrukcyjnego czyszczenia.

Czy nowe dyski mogą zawierać stare metadane?

Tak, zwłaszcza jeśli były testowane lub wcześniej partycjonowane, ale potwierdź to za pomocą polecenia wipefs -n lub mdadm --examine.

Czy RAID 0 jest bezpieczny dla kopii zapasowych?

Nie. Utrata jednego członka oznacza utratę całej macierzy, dlatego przechowuj niezależne kopie.

Skąd mam wiedzieć, że macierz RAID została utworzona poprawnie?

Sprawdź /proc/mdstat oraz stan systemu plików i montowania, uruchom system ponownie i upewnij się, że macierz nadal działa prawidłowo.