Tablica RAID pozostaje zdegradowana, gdy zamiennik jest widoczny, ale nie stał się ważnym członkiem odbudowującym. Częste przyczyny to niewłaściwy rozmiar, obce metadane, nieobsługiwany stan, brak ręcznego przypisania lub inny uszkodzony dysk źródłowy.
Nie inicjuj zamiennika ani nie importuj obcej konfiguracji losowo. Najpierw zidentyfikuj dokładną tablicę, brakującą rolę, numer seryjny zamiennika, stan kontrolera i kwalifikowalność do odbudowy. Celem jest podłączenie pustego kwalifikującego się celu bez zmiany zaufanej konfiguracji źródłowej.
Potwierdź, że zamiennik jest widoczny przez właściwy kontroler
Dysk może pojawić się w systemie operacyjnym, pozostając niedostępny dla kontrolera RAID lub być widoczny dla kontrolera w innym slocie obudowy niż oczekiwano. Porównaj fizyczny numer seryjny, zatokę, port kontrolera i zgłaszaną liczbę sektorów.
Jeśli nowy dysk nie jest widoczny na warstwie RAID, sprawdź zasilanie, płytę tylnią, kabel, tryb HBA i mapowanie obudowy przed zmianą metadanych tablicy. Wielokrotne wkładanie bez identyfikacji numeru seryjnego może prowadzić do obsługi niewłaściwego członka.
Gotowy, Nie skonfigurowany i Zapasowy nie oznaczają odbudowy
Wiele kontrolerów sprzętowych umieszcza nowy dysk w stanie neutralnym, takim jak Gotowy lub Nie skonfigurowany Dobry. Tablica pozostaje zdegradowana, dopóki dysk nie zostanie przypisany jako zamiennik, dedykowany zapasowy lub kwalifikujący się globalny gorący zapas zgodnie z procedurą kontrolera.
Nowy dysk w stanie Gotowy to dobry przykład: sama obecność nie wypełnia brakującej roli w RAID. Sprawdź, czy wymagane jest gorące włożenie, ręczna wymiana lub przypisanie zapasowego dysku.
Oprogramowanie RAID zazwyczaj wymaga wyraźnego dodania
Tablice md w Linuksie niekoniecznie ponownie dodają zniknięty dysk tylko dlatego, że urządzenie blokowe pojawiło się ponownie pod tą samą ścieżką. Stary członek może nadal być oznaczony jako usunięty, podczas gdy zamiennik istnieje tylko jako nieużywane urządzenie.
Zachowanie ręcznego ponownego dodania mdadm odzwierciedla granicę bezpieczeństwa: automatyczne zaufanie urządzeniu, które wcześniej zniknęło, może być gorsze niż wymóg, by administrator zweryfikował je i dodał świadomie.
Obce metadane mogą blokować wymianę
Używany dysk może zawierać sygnatury RAID z innej macierzy. Kontrolery oznaczają to jako obce, ponieważ import mógłby zmienić aktywną konfigurację. Nowy dysk może też mieć fabryczne, testowe lub poprzednie metadane, które uniemożliwiają automatyczną kwalifikację.
Nie importuj obcej konfiguracji z dysku przeznaczonego na pustą wymianę. W przypadku stanu obcego dysku wymiennego właściwą ścieżką było zmienienie nowego członka na stan nie skonfigurowany-dobry, a nie importowanie jego starej definicji macierzy.
Pojemność i geometria sektorów muszą spełniać minimalne wymagania macierzy
Dysk wymienny musi zapewniać co najmniej tyle samo użytecznych sektorów, co uszkodzony członek. Dysk nominalnie równy może być nieco mniejszy. Niektóre kontrolery odrzucają też zmianę formatu logicznego lub fizycznego sektora, typu interfejsu, kwalifikacji firmware’u lub możliwości szyfrowania.
Porównaj dokładny rozmiar i format sektora, a nie tylko etykietę na pudełku. Jeśli kontroler zgłasza nowy dysk jako nieobsługiwany lub zbyt mały, nie wymuszaj jego aktywacji; wybierz kompatybilny, większy cel.
Inny dysk źródłowy może uniemożliwiać odbudowę
Odbudowa wymaga czytelnych danych od pozostałych członków. Jeśli inny dysk ma nieodwracalne uszkodzone sektory, powtarzające się przekroczenia czasu lub wypada z macierzy, kontroler może przerwać operację, zachować wymieniany dysk jako zapasowy lub pozostać zdegradowany po nieudanej próbie odbudowy.
Przejrzyj dziennik zdarzeń od momentu awarii oryginalnego dysku aż do próby wymiany. Najnowszy alert może dotyczyć celu, podczas gdy faktyczną przeszkodą jest błąd odczytu na innym członku źródłowym.
Użyj kolejności rozwiązywania problemów opartej na stanie
| Stan wymiany | Prawdopodobne znaczenie | Następne sprawdzenie |
|---|---|---|
| Nie wykryto | Problem z połączeniem lub ścieżką kontrolera | Zasilanie, kabel, zatoka, HBA, mapa szeregowa |
| Gotowy / Nie skonfigurowany, dobry | Widoczny, ale nieprzypisany | Przypisanie wymiany lub zapasowego |
| Obcy | Obecne stare metadane RAID | Zweryfikuj tożsamość; wyczyść tylko metadane nowego celu |
| Zbyt mały / nieobsługiwany | Niekwalifikowalność | Dokładne sektory, format, wsparcie kontrolera |
| Zapasowy, nie odbudowujący | Brak wyzwalacza lub błędu źródła | Brakująca rola, polityka, logi członka ocalałego |
| Odbudowa przerwana | Źródło lub ścieżka nie mogły zostać ukończone | Błędy odczytu, przekroczenia czasu, drugie uszkodzenie |
Specyficzne dla kontrolera ręczne przypisanie odbudowy może używać akcji gorącego zapasu do wyzwolenia odzyskiwania. Używaj udokumentowanego przejścia stanu platformy zamiast ogólnych poleceń skopiowanych z innego stosu RAID.
Zweryfikuj wyzwalacz odbudowy przed opuszczeniem systemu
Po przypisaniu wymiany obserwuj wystarczająco długo, aby potwierdzić, że przetwarzane bloki rosną, a zamierzony numer seryjny jest celem. Przejście stanu, które się rozpoczyna i natychmiast przerywa, to nadal zdegradowana tablica, nawet jeśli panel chwilowo pokazał odbudowę.
Zapisz pierwszy błąd po przerwaniu. Często identyfikuje rzeczywisty problem wyraźniej niż ostateczne podsumowanie, zwłaszcza gdy działający dysk źródłowy przekracza limit czasu lub kontroler odrzuca geometrię celu.
FAQ
Czy powinienem najpierw zainicjalizować wymieniany dysk?
Zazwyczaj nie. Inicjalizacja może zapisać metadane i może być destrukcyjna, jeśli wybrano niewłaściwy dysk. Przygotuj tylko potwierdzony pusty cel, korzystając z procedury wymiany kontrolera.
Dlaczego zimna wymiana pozostawiła nowy dysk nieużywany?
Niektóre kontrolery wykrywają i przypisują wymianę inaczej podczas gorącej wymiany. Zimna wymiana może pozostawić brakującą rolę oraz osobny gotowy dysk, który musi być przypisany ręcznie.
Czy mogę wymusić podłączenie dysku online?
Akcje wymuszonego online są przeznaczone do konkretnych sytuacji odzyskiwania i mogą promować przestarzałe dane. Dla nowej pustej wymiany przypisz ją jako cel odbudowy lub zapas zamiast udawać, że zawiera aktualne dane tablicy.
Tablica staje się zdrowa dopiero po zmianach członkostwa
Widoczna wymiana nie usuwa statusu zdegradowanego. Musi być kwalifikowalna, przypisana do brakującej roli, odbudowana z czytelnych źródeł i promowana do aktywnego zsynchronizowanego członka.
Wsparcie i wskazówki
Więcej do przeczytania

Dlaczego macierz RAID staje się nieaktywna po utracie zasilania?
Nieaktywna macierz często oznacza, że znaleziono metadane, ale system nie miał wystarczającej pewności ani członków, aby bezpiecznie ją uruchomić po nieprawidłowym zamknięciu.

Jakie są ryzyka związane z wymuszaniem ponownego podłączenia brakującego członka RAID?
Opcje wymuszania mogą ominąć kontrole bezpieczeństwa dotyczące przestarzałych metadanych, niezsynchronizowanej parzystości, brakujących zapisów lub aktywnych pul; przed ich użyciem sprawdź i zachowaj dowody.

Jak odróżnić uszkodzony kabel SATA od uszkodzonego dysku NAS
Śledź, czy błędy dotyczą dysku, czy pozostają na ścieżce SATA, i oddziel liczniki transportu od dowodów stanu nośnika przed wymianą sprzętu.
