Solução da comunidade

Estado de saída 2 do RAID do ZimaOS: reinicie antes de apagar os discos

Two new 4 TB disks worked individually but RAID creation returned exit status 2 until ZimaOS was rebooted after disk deactivation.

Em resumo: reinicie depois de desativar os discos antes de começar a apagar metadados

No caso resolvido, dois HDD novos de 4 TB funcionavam como discos autónomos, mas a criação de RAID 0/1 devolvia um exit status 2 genérico. Não foi necessário substituir nem apagar os discos: reiniciar o ZimaOS depois de desativar as unidades limpou o estado de armazenamento obsoleto e a criação do RAID foi bem-sucedida. Este deve ser o primeiro teste de baixo risco.

Confirme que ambos os discos estão realmente livres

lsblk -f
mount
cat /proc/mdstat

Ambas as unidades candidatas devem estar desmontadas e não podem já ser membros de outro conjunto md ou de um pool ativo do ZimaOS. Não deduza isto apenas pelo rótulo apresentado na interface se a criação já tiver falhado.

Reinicie uma vez antes da limpeza destrutiva

Desative as duas unidades em Armazenamento, reinicie o ZimaOS, volte a Armazenamento e tente criar o RAID novamente. Isto é especialmente útil quando a interface ou o serviço de armazenamento ainda pode manter um estado obsoleto da configuração autónoma anterior.

Se continuar a falhar, registe o erro real

journalctl -xb | tail -200
dmesg | tail -200

exit status 2 é apenas uma mensagem de erro genérica. A causa útil pode estar relacionada com o estado do mdadm, assinaturas de sistemas de ficheiros obsoletas, um conflito de montagem ou outra falha do serviço de armazenamento. O comportamento do RAID mdadm no Linux explica a camada do conjunto.

Inspecione os metadados antes de os apagar

sudo wipefs -n /dev/sdX
sudo mdadm --examine /dev/sdX 2>/dev/null

Utilize primeiro o modo de inspeção. Se mais tarde remover assinaturas, certifique-se de que os discos não contêm dados de que necessita. Não transforme “wipefs -a tudo” na resposta predefinida para um erro genérico da interface.

As versões atuais do ZimaOS suportam diretamente RAID 0 e RAID 1

A documentação atual de armazenamento abrange RAID 0, RAID 1, RAID 5, RAID 6 e JBOD. O RAID 0 requer pelo menos dois discos e não oferece redundância; o RAID 1 cria um espelho entre dois discos. Os níveis de RAID do ZimaOS são a referência atual do produto.

Não utilize RAID 0 para dados que não possa recriar

O RAID 0 aumenta a capacidade utilizável e pode melhorar o desempenho, mas a falha de um membro destrói o conjunto. Se estes discos de 4 TB contiverem multimédia ou cópias de segurança importantes, pondere se RAID 1/5, juntamente com uma cópia de segurança independente, é mais adequado.

A cópia de segurança do ZimaOS e a recuperação de RAID explicam o modelo de falhas.

Verifique o novo conjunto antes de carregar dados

cat /proc/mdstat
lsblk -f
df -h

Aguarde até terminarem quaisquer operações de inicialização ou ressincronização e, em seguida, copie primeiro dados de teste que não sejam importantes. Reinicie uma vez e confirme que o conjunto regressa a um estado saudável antes de guardar a única cópia de ficheiros importantes.

A diferença de tamanho dos discos não deve ser a primeira conclusão

Pequenas diferenças nominais podem afetar o tamanho utilizável, mas, neste caso, o simples reinício resolveu o problema. Analise os registos reais antes de atribuir um código de estado genérico a uma diferença entre unidades ou a uma falha de hardware.

Se os metadados forem realmente o problema, remova apenas o que identificou

As verificações de assinaturas do wipefs do Linux podem mostrar assinaturas de sistemas de ficheiros, tabelas de partições e RAID antes de qualquer eliminação. Se confirmar que os discos estão vazios e os registos apontarem para assinaturas obsoletas, remova deliberadamente os metadados específicos, reinicie e tente novamente. Isto é mais seguro do que tratar qualquer erro genérico de RAID como autorização para apagar imediatamente ambas as unidades.

Depois da limpeza, execute novamente lsblk -f e mdadm --examine para confirmar que as unidades estão realmente no estado esperado pelo ZimaOS antes de voltar a abrir o fluxo de criação do RAID.

Quando o reinício resolver imediatamente a criação, registe esse resultado nas notas do incidente. É uma evidência útil de que não ficou provado que os próprios discos estavam avariados e de que um estado obsoleto do serviço era a explicação mais provável.

FAQ

O que significa exit status 2 na criação de RAID do ZimaOS?

É um resultado genérico de falha, não um diagnóstico. Consulte os registos para encontrar o erro subjacente do armazenamento ou do mdadm.

Devo apagar imediatamente os discos?

Não. Primeiro reinicie depois de os desativar e, em seguida, inspecione os metadados antes de efetuar uma limpeza destrutiva.

Os discos novos podem ter metadados antigos?

Sim, especialmente se tiverem sido testados ou particionados anteriormente, mas confirme-o com wipefs -n ou mdadm --examine.

O RAID 0 é seguro para cópias de segurança?

Não. A perda de um membro implica a perda do conjunto, por isso mantenha cópias independentes.

Como sei se o RAID foi criado corretamente?

Verifique /proc/mdstat, o estado do sistema de ficheiros e das montagens, reinicie e confirme que o conjunto continua saudável.