Soluzione della community

Disco mancante in RAID5 su una nuova configurazione ZimaOS: cosa controllare

A new three-disk RAID5 alternated between one missing disk and all disks missing, suggesting unstable drive detection rather than a normal single-disk failure.

Se un RAID5 appena creato alterna tra un disco mancante e tutti i dischi mancanti, interrompi la ricostruzione e verifica prima che tutte e tre le unità vengano rilevate in modo coerente. Questo schema indica più probabilmente un problema di alimentazione, cablaggio, backplane/controller o instabilità nel rilevamento dei dischi, piuttosto che tre guasti RAID simultanei.

L'attuale RAID5 di ZimaOS richiede almeno tre dischi e dovrebbe mostrare un membro guasto come Degradato. Riavviare ripetutamente il sistema non risolve la scomparsa intermittente del percorso di un'unità.

Passaggio 1: controlla ogni disco al di fuori della vista RAID

lsblk -o NAME,SIZE,MODEL,SERIAL,TRAN
dmesg | grep -Ei 'ata|sas|scsi|reset|error|fail' | tail -150

Esegui i controlli dopo diversi avvii a freddo. Tutti e tre i dischi da 16 TB dovrebbero comparire ogni volta con informazioni stabili su modello e numero di serie.

Passaggio 2: ricollega le connessioni di alimentazione e dati

Spegni completamente il sistema prima di ricollegare dischi, cavi SATA/SAS, connettori del backplane o connessioni HBA. Un grande disco da 3,5 pollici può scomparire durante l'avvio del motore se l'alimentazione è insufficiente.

Passaggio 3: controlla lo stato SMART di ogni disco

smartctl -x /dev/sdX

Cerca test automatici non superati, errori del supporto, timeout dei comandi, settori in attesa o errori dell'interfaccia. Anche un disco nuovo può essere difettoso.

Passaggio 4: controlla lo stato del RAID

L'attuale guida alla configurazione dello storage di ZimaOS indica che un membro guasto dovrebbe rendere l'array Degradato, lasciando comunque accessibili i dati.

Gli utenti esperti possono anche controllare:

cat /proc/mdstat
mdadm --detail /dev/mdX

Usa questi comandi solo se l'array attuale è basato su md e conosci il dispositivo corretto.

Non ricreare il RAID finché il rilevamento non è stabile

Se tutti i dischi scompaiono a intermittenza, una nuova creazione pulita del RAID fallirà semplicemente di nuovo. Risolvi prima il problema del percorso hardware/controller.

RAID5 richiede tre membri affidabili

L'attuale guida RAID5 di ZimaOS descrive RAID5 come uno storage con parità singola, in grado di sopportare il guasto di un membro. Non è progettato per tollerare il rilevamento instabile di più dischi.

Esegui un backup prima di ricostruire un array esistente

Se il pool contiene già dati, non eliminarlo e ricrearlo solo perché l'interfaccia segnala un membro mancante. Proteggi prima i dati e determina se il disco è davvero guasto o se è semplicemente scomparso dal controller.

Controlla separatamente la logica di sostituzione/ricostruzione

Se uno specifico disco risulta costantemente guasto, sostituisci solo quello e segui la procedura di ricostruzione di ZimaOS. Non inizializzare casualmente il disco sostitutivo né aggiungerlo a un nuovo pool.

La guida alla risoluzione dei problemi di ricostruzione RAID fornisce il passaggio successivo dopo che il rilevamento è stabile.

Domande frequenti

Perché un RAID5 appena creato indica Disco mancante?

Un disco potrebbe essersi disconnesso durante la creazione oppure potrebbe non essere rilevato in modo affidabile a causa di alimentazione, cablaggio, backplane o controller.

Devo riavviare ripetutamente il sistema?

No. Usa invece controlli ripetuti del rilevamento per diagnosticare il percorso hardware instabile.

RAID5 può funzionare con due dischi?

No. L'attuale RAID5 di ZimaOS richiede almeno tre dischi.

Devo ricreare il RAID da zero se a volte tutti i dischi scompaiono?

No. Risolvi prima il problema del rilevamento dei dischi; altrimenti il nuovo array potrebbe guastarsi nello stesso modo.