Cosa causa il mantenimento dello stato degradato di un array RAID dopo l'aggiunta di un disco di sostituzione?

Eva Wong è la Technical Writer e smanettatrice residente di ZimaSpace. Una geek da sempre con una passione per homelab e software open-source, si specializza nel tradurre concetti tecnici complessi in guide accessibili e pratiche. Eva crede che l'auto-ospitare debba essere divertente, non intimidatorio. Attraverso i suoi tutorial, dà potere alla comunità di demistificare le configurazioni hardware, dalla costruzione del loro primo NAS al dominio dei container Docker.

Un array RAID rimane degradato quando la sostituzione è visibile ma non è diventata un membro valido per la ricostruzione. Cause comuni sono dimensioni errate, metadati esterni, stato non supportato, mancanza di assegnazione manuale o un altro disco sorgente guasto.

Non inizializzare la sostituzione né importare una configurazione esterna a caso. Prima identificare l'array esatto, il ruolo mancante, il numero seriale della sostituzione, lo stato del controller e l'idoneità alla ricostruzione. L'obiettivo è collegare un target vuoto idoneo senza modificare la configurazione della fonte attendibile.

Confermare che la sostituzione sia vista dal controller corretto

Un disco può apparire nel sistema operativo pur rimanendo non disponibile al controller RAID, o apparire al controller in uno slot dell'involucro diverso da quello previsto. Confrontare il numero seriale fisico, il bay, la porta del controller e il conteggio dei settori riportato.

Se il nuovo disco non è visibile a livello RAID, controllare alimentazione, backplane, cavo, modalità HBA e mappatura dell'involucro prima di modificare i metadati dell'array. Inserimenti ripetuti senza identificare il seriale possono portare a intervenire sul membro sbagliato.

Ready, Unconfigured e Spare non significano che si sta ricostruendo

Molti controller hardware pongono un nuovo disco in uno stato neutro come Ready o Unconfigured Good. L'array rimane degradato finché il disco non viene assegnato come sostituto, riserva dedicata o riserva globale idonea secondo il flusso di lavoro del controller.

Un nuovo disco in stato Ready è un esempio utile: la sola presenza non copre il ruolo mancante nel RAID. Verificare se è necessario un inserimento a caldo, una sostituzione manuale o l'assegnazione di una riserva.

Il RAID software di solito richiede un'aggiunta esplicita

Gli array md di Linux non riaggiungono necessariamente un disco scomparso solo perché un dispositivo a blocchi è tornato nello stesso percorso. Il vecchio membro potrebbe essere ancora contrassegnato come rimosso, mentre la sostituzione esiste solo come dispositivo inutilizzato.

Il comportamento di riaggiunta manuale con mdadm riflette un limite di sicurezza: fidarsi automaticamente di un dispositivo che è scomparso in precedenza può essere peggio che richiedere a un amministratore di verificarlo e aggiungerlo deliberatamente.

I metadati esterni possono bloccare la sostituzione

Un disco riutilizzato può contenere firme RAID di un altro array. I controller lo etichettano come esterno perché importarlo potrebbe alterare la configurazione attiva. Un disco nuovo di fabbrica può anche portare metadati di fabbrica, test o uso precedente che impediscono l'idoneità automatica.

Non importare configurazioni esterne da un disco destinato a essere una sostituzione vuota. In un caso di stato di disco sostitutivo esterno, cambiare il nuovo membro in stato non configurato-buono era la strada corretta, non importare la sua vecchia definizione di array.

Capacità e geometria dei settori devono rispettare il minimo dell'array

La sostituzione deve fornire almeno tanti settori utilizzabili quanti ne aveva il membro guasto. Un disco nominalmente uguale può essere leggermente più piccolo. Alcuni controller rifiutano anche un cambiamento nel formato logico o fisico dei settori, tipo di interfaccia, qualificazione firmware o capacità di crittografia.

Confronta la dimensione esatta e il formato dei settori invece della sola etichetta sulla scatola. Se il controller segnala il nuovo disco come non supportato o troppo piccolo, non forzarlo online; scegli un target compatibile più grande.

Un altro disco sorgente potrebbe impedire la ricostruzione

Una ricostruzione necessita di dati leggibili dai membri sopravvissuti. Se un altro disco ha settori irrecuperabili, timeout ripetuti o viene rimosso dall'array, il controller può abortire, mantenere la sostituzione come riserva o rimanere degradato dopo un tentativo di ricostruzione fallito.

Esamina il registro eventi dal momento in cui il disco originale ha smesso di funzionare fino al tentativo di sostituzione. L'ultimo avviso potrebbe riferirsi al target, mentre il vero blocco è un errore di lettura su un altro membro sorgente.

Usa un ordine di risoluzione dei problemi basato sullo stato

Stato di sostituzione Significato probabile Prossimo controllo
Non rilevato Problema di connessione o percorso del controller Alimentazione, cavo, bay, HBA, mappa seriale
Pronto / Non configurato Buono Visibile ma non assegnato Assegnazione sostituzione o riserva
Esterno Metadati RAID vecchi presenti Verifica identità; cancella solo i metadati del nuovo obiettivo
Troppo piccolo / non supportato Fallimento idoneità Settori esatti, formato, supporto controller
Riserva, non in ricostruzione Nessun trigger o errore sorgente Ruolo mancante, politica, log del membro sopravvissuto
Ricostruzione abortita Sorgente o percorso non completati Errori di lettura, timeout, secondo guasto

Un assegnamento manuale specifico del controller può usare un'azione di hot-spare per attivare il recupero. Usa la transizione di stato documentata della piattaforma invece di comandi generici copiati da un altro stack RAID.

Verifica il trigger di ricostruzione prima di lasciare il sistema

Una volta assegnata la sostituzione, osserva abbastanza a lungo per confermare che i blocchi elaborati aumentino e che il numero di serie previsto sia l'obiettivo. Una transizione di stato che inizia e si interrompe immediatamente è ancora un array degradato, anche quando il cruscotto ha mostrato brevemente la ricostruzione.

Salva il primo errore dopo un aborto. Spesso identifica il vero blocco più chiaramente del riepilogo finale, specialmente quando un disco sorgente sopravvissuto va in timeout o il controller rifiuta la geometria dell'obiettivo.

FAQ

Devo inizializzare prima il disco di sostituzione?

Di solito no. L'inizializzazione può scrivere metadati e può essere distruttiva se viene selezionato il disco sbagliato. Prepara solo l'obiettivo vuoto confermato utilizzando il flusso di lavoro di sostituzione del controller.

Perché lo scambio a freddo ha lasciato il nuovo disco inutilizzato?

Alcuni controller rilevano e associano una sostituzione in modo diverso durante l'inserimento a caldo. Lo scambio a freddo può lasciare un ruolo mancante più un disco pronto separato che deve essere assegnato manualmente.

Posso forzare l'unità online?

Le azioni di forzatura online sono destinate a situazioni di recupero specifiche e possono promuovere dati obsoleti. Per una nuova sostituzione vuota, assegnala come obiettivo di ricostruzione o come riserva invece di fingere che contenga dati attuali dell'array.

L'array diventa sano solo dopo le modifiche di appartenenza

Una sostituzione visibile non rimuove lo stato degradato. Deve essere idonea, assegnata al ruolo mancante, ricostruita da fonti leggibili e promossa a membro attivo sincronizzato.

Supporto e consigli

Altro da leggere

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.