Se un RAID5 appena creato alterna tra un disco mancante e tutti i dischi mancanti, interrompi la ricostruzione e verifica prima che tutte e tre le unità vengano rilevate in modo coerente. Questo schema indica più probabilmente un problema di alimentazione, cablaggio, backplane/controller o instabilità nel rilevamento dei dischi, piuttosto che tre guasti RAID simultanei.
L'attuale RAID5 di ZimaOS richiede almeno tre dischi e dovrebbe mostrare un membro guasto come Degradato. Riavviare ripetutamente il sistema non risolve la scomparsa intermittente del percorso di un'unità.
Passaggio 1: controlla ogni disco al di fuori della vista RAID
lsblk -o NAME,SIZE,MODEL,SERIAL,TRAN
dmesg | grep -Ei 'ata|sas|scsi|reset|error|fail' | tail -150
Esegui i controlli dopo diversi avvii a freddo. Tutti e tre i dischi da 16 TB dovrebbero comparire ogni volta con informazioni stabili su modello e numero di serie.
Passaggio 2: ricollega le connessioni di alimentazione e dati
Spegni completamente il sistema prima di ricollegare dischi, cavi SATA/SAS, connettori del backplane o connessioni HBA. Un grande disco da 3,5 pollici può scomparire durante l'avvio del motore se l'alimentazione è insufficiente.
Passaggio 3: controlla lo stato SMART di ogni disco
smartctl -x /dev/sdX
Cerca test automatici non superati, errori del supporto, timeout dei comandi, settori in attesa o errori dell'interfaccia. Anche un disco nuovo può essere difettoso.
Passaggio 4: controlla lo stato del RAID
L'attuale guida alla configurazione dello storage di ZimaOS indica che un membro guasto dovrebbe rendere l'array Degradato, lasciando comunque accessibili i dati.
Gli utenti esperti possono anche controllare:
cat /proc/mdstat
mdadm --detail /dev/mdX
Usa questi comandi solo se l'array attuale è basato su md e conosci il dispositivo corretto.
Non ricreare il RAID finché il rilevamento non è stabile
Se tutti i dischi scompaiono a intermittenza, una nuova creazione pulita del RAID fallirà semplicemente di nuovo. Risolvi prima il problema del percorso hardware/controller.
RAID5 richiede tre membri affidabili
L'attuale guida RAID5 di ZimaOS descrive RAID5 come uno storage con parità singola, in grado di sopportare il guasto di un membro. Non è progettato per tollerare il rilevamento instabile di più dischi.
Esegui un backup prima di ricostruire un array esistente
Se il pool contiene già dati, non eliminarlo e ricrearlo solo perché l'interfaccia segnala un membro mancante. Proteggi prima i dati e determina se il disco è davvero guasto o se è semplicemente scomparso dal controller.
Controlla separatamente la logica di sostituzione/ricostruzione
Se uno specifico disco risulta costantemente guasto, sostituisci solo quello e segui la procedura di ricostruzione di ZimaOS. Non inizializzare casualmente il disco sostitutivo né aggiungerlo a un nuovo pool.
La guida alla risoluzione dei problemi di ricostruzione RAID fornisce il passaggio successivo dopo che il rilevamento è stabile.
Domande frequenti
Perché un RAID5 appena creato indica Disco mancante?
Un disco potrebbe essersi disconnesso durante la creazione oppure potrebbe non essere rilevato in modo affidabile a causa di alimentazione, cablaggio, backplane o controller.
Devo riavviare ripetutamente il sistema?
No. Usa invece controlli ripetuti del rilevamento per diagnosticare il percorso hardware instabile.
RAID5 può funzionare con due dischi?
No. L'attuale RAID5 di ZimaOS richiede almeno tre dischi.
Devo ricreare il RAID da zero se a volte tutti i dischi scompaiono?
No. Risolvi prima il problema del rilevamento dei dischi; altrimenti il nuovo array potrebbe guastarsi nello stesso modo.
