Un array RAID rimane degradato quando la sostituzione è visibile ma non è diventata un membro valido per la ricostruzione. Cause comuni sono dimensioni errate, metadati esterni, stato non supportato, mancanza di assegnazione manuale o un altro disco sorgente guasto.
Non inizializzare la sostituzione né importare una configurazione esterna a caso. Prima identificare l'array esatto, il ruolo mancante, il numero seriale della sostituzione, lo stato del controller e l'idoneità alla ricostruzione. L'obiettivo è collegare un target vuoto idoneo senza modificare la configurazione della fonte attendibile.
Confermare che la sostituzione sia vista dal controller corretto
Un disco può apparire nel sistema operativo pur rimanendo non disponibile al controller RAID, o apparire al controller in uno slot dell'involucro diverso da quello previsto. Confrontare il numero seriale fisico, il bay, la porta del controller e il conteggio dei settori riportato.
Se il nuovo disco non è visibile a livello RAID, controllare alimentazione, backplane, cavo, modalità HBA e mappatura dell'involucro prima di modificare i metadati dell'array. Inserimenti ripetuti senza identificare il seriale possono portare a intervenire sul membro sbagliato.
Ready, Unconfigured e Spare non significano che si sta ricostruendo
Molti controller hardware pongono un nuovo disco in uno stato neutro come Ready o Unconfigured Good. L'array rimane degradato finché il disco non viene assegnato come sostituto, riserva dedicata o riserva globale idonea secondo il flusso di lavoro del controller.
Un nuovo disco in stato Ready è un esempio utile: la sola presenza non copre il ruolo mancante nel RAID. Verificare se è necessario un inserimento a caldo, una sostituzione manuale o l'assegnazione di una riserva.
Il RAID software di solito richiede un'aggiunta esplicita
Gli array md di Linux non riaggiungono necessariamente un disco scomparso solo perché un dispositivo a blocchi è tornato nello stesso percorso. Il vecchio membro potrebbe essere ancora contrassegnato come rimosso, mentre la sostituzione esiste solo come dispositivo inutilizzato.
Il comportamento di riaggiunta manuale con mdadm riflette un limite di sicurezza: fidarsi automaticamente di un dispositivo che è scomparso in precedenza può essere peggio che richiedere a un amministratore di verificarlo e aggiungerlo deliberatamente.
I metadati esterni possono bloccare la sostituzione
Un disco riutilizzato può contenere firme RAID di un altro array. I controller lo etichettano come esterno perché importarlo potrebbe alterare la configurazione attiva. Un disco nuovo di fabbrica può anche portare metadati di fabbrica, test o uso precedente che impediscono l'idoneità automatica.
Non importare configurazioni esterne da un disco destinato a essere una sostituzione vuota. In un caso di stato di disco sostitutivo esterno, cambiare il nuovo membro in stato non configurato-buono era la strada corretta, non importare la sua vecchia definizione di array.
Capacità e geometria dei settori devono rispettare il minimo dell'array
La sostituzione deve fornire almeno tanti settori utilizzabili quanti ne aveva il membro guasto. Un disco nominalmente uguale può essere leggermente più piccolo. Alcuni controller rifiutano anche un cambiamento nel formato logico o fisico dei settori, tipo di interfaccia, qualificazione firmware o capacità di crittografia.
Confronta la dimensione esatta e il formato dei settori invece della sola etichetta sulla scatola. Se il controller segnala il nuovo disco come non supportato o troppo piccolo, non forzarlo online; scegli un target compatibile più grande.
Un altro disco sorgente potrebbe impedire la ricostruzione
Una ricostruzione necessita di dati leggibili dai membri sopravvissuti. Se un altro disco ha settori irrecuperabili, timeout ripetuti o viene rimosso dall'array, il controller può abortire, mantenere la sostituzione come riserva o rimanere degradato dopo un tentativo di ricostruzione fallito.
Esamina il registro eventi dal momento in cui il disco originale ha smesso di funzionare fino al tentativo di sostituzione. L'ultimo avviso potrebbe riferirsi al target, mentre il vero blocco è un errore di lettura su un altro membro sorgente.
Usa un ordine di risoluzione dei problemi basato sullo stato
| Stato di sostituzione | Significato probabile | Prossimo controllo |
|---|---|---|
| Non rilevato | Problema di connessione o percorso del controller | Alimentazione, cavo, bay, HBA, mappa seriale |
| Pronto / Non configurato Buono | Visibile ma non assegnato | Assegnazione sostituzione o riserva |
| Esterno | Metadati RAID vecchi presenti | Verifica identità; cancella solo i metadati del nuovo obiettivo |
| Troppo piccolo / non supportato | Fallimento idoneità | Settori esatti, formato, supporto controller |
| Riserva, non in ricostruzione | Nessun trigger o errore sorgente | Ruolo mancante, politica, log del membro sopravvissuto |
| Ricostruzione abortita | Sorgente o percorso non completati | Errori di lettura, timeout, secondo guasto |
Un assegnamento manuale specifico del controller può usare un'azione di hot-spare per attivare il recupero. Usa la transizione di stato documentata della piattaforma invece di comandi generici copiati da un altro stack RAID.
Verifica il trigger di ricostruzione prima di lasciare il sistema
Una volta assegnata la sostituzione, osserva abbastanza a lungo per confermare che i blocchi elaborati aumentino e che il numero di serie previsto sia l'obiettivo. Una transizione di stato che inizia e si interrompe immediatamente è ancora un array degradato, anche quando il cruscotto ha mostrato brevemente la ricostruzione.
Salva il primo errore dopo un aborto. Spesso identifica il vero blocco più chiaramente del riepilogo finale, specialmente quando un disco sorgente sopravvissuto va in timeout o il controller rifiuta la geometria dell'obiettivo.
FAQ
Devo inizializzare prima il disco di sostituzione?
Di solito no. L'inizializzazione può scrivere metadati e può essere distruttiva se viene selezionato il disco sbagliato. Prepara solo l'obiettivo vuoto confermato utilizzando il flusso di lavoro di sostituzione del controller.
Perché lo scambio a freddo ha lasciato il nuovo disco inutilizzato?
Alcuni controller rilevano e associano una sostituzione in modo diverso durante l'inserimento a caldo. Lo scambio a freddo può lasciare un ruolo mancante più un disco pronto separato che deve essere assegnato manualmente.
Posso forzare l'unità online?
Le azioni di forzatura online sono destinate a situazioni di recupero specifiche e possono promuovere dati obsoleti. Per una nuova sostituzione vuota, assegnala come obiettivo di ricostruzione o come riserva invece di fingere che contenga dati attuali dell'array.
L'array diventa sano solo dopo le modifiche di appartenenza
Una sostituzione visibile non rimuove lo stato degradato. Deve essere idonea, assegnata al ruolo mancante, ricostruita da fonti leggibili e promossa a membro attivo sincronizzato.
Supporto e consigli
Altro da leggere

Perché un array RAID diventa inattivo dopo un'interruzione di corrente?
Un array inattivo spesso significa che sono stati trovati i metadati, ma il sistema non aveva sufficiente fiducia o membri per avviarlo in modo...

Quali sono i rischi di forzare il ripristino online di un membro RAID mancante?
Le opzioni di forzatura possono bypassare i controlli di sicurezza relativi a metadati obsoleti, parità sporca, scritture mancanti o pool attivi; ispeziona e conserva...

Come Distinguere un Cavo SATA Difettoso da un Disco NAS in Guarigione
Monitora se gli errori seguono il disco o rimangono con il percorso SATA, e separa i contatori di trasporto dalle evidenze di salute del...
