Solução da comunidade

Recuperar um RAID 5 do ZimaOS após a falha de uma unidade: substitua o disco, siga as instruções de reconstrução e verifique a matriz

A May 2025 ZimaCube case where one disk in a four-drive 12 TB RAID5 was marked Damaged. The user powered down, replaced the failed disk, powered up, followed the ZimaOS prompts, and reported that the array immediately began an estimated 13.5-hour recovery.

A recuperação da origem foi simples e confirmada pelo utilizador: um RAID 5 de quatro discos tinha uma unidade marcada como Danificada. O proprietário desligou o ZimaCube, substituiu esse disco, voltou a ligar o sistema, seguiu as indicações de armazenamento do ZimaOS e informou que a reconstrução tinha começado, com uma estimativa de 13,5 horas restantes.

A documentação atual do ZimaOS descreve agora este mesmo fluxo gerido de forma mais explícita: quando um disco RAID falha, o conjunto fica degradado, os dados continuam acessíveis e, depois de o disco com falha ser substituído, o ZimaOS orienta o utilizador durante a reconstrução. A fonte antiga também referia que outro conjunto RAID 0 passou a ser só de leitura ao mesmo tempo; a documentação atual não descreve esse comportamento como normal e permanente para todos os conjuntos não relacionados.

Confirme Qual Foi Realmente o Disco Físico que Falhou

Antes de retirar qualquer disco, associe o estado do armazenamento no ZimaOS à baía física e ao número de série. Num RAID 5 degradado, remover o membro saudável errado pode transformar uma falha de um único disco numa interrupção muito mais perigosa de vários discos.

Copie os Dados Críticos Antes da Reconstrução, se o Conjunto Ainda Estiver Acessível

O RAID 5 suporta a falha de um membro, mas a reconstrução faz leituras intensivas em todos os discos sobreviventes. Se outro disco tiver um estado SMART problemático ou setores ilegíveis, é durante a reconstrução que essas fragilidades se tornam mais relevantes.

Se o conjunto estiver acessível e os dados forem insubstituíveis, copie os ficheiros mais importantes para um armazenamento independente antes de iniciar uma reconstrução longa, sempre que for viável.

A Fonte Substituiu o Disco com o Sistema Desligado

O autor da publicação desligou o ZimaCube antes de trocar o disco danificado. Esta é a opção predefinida mais segura quando não está explicitamente a utilizar um fluxo de substituição a quente documentado.

Depois de instalar o disco de substituição, ligue o sistema e deixe o ZimaOS detetar o conjunto degradado e o novo disco elegível.

Utilize a Indicação de Reconstrução do ZimaOS

O utilizador da fonte não publicou nenhum comando manual de reparação mdadm. Seguiu as indicações da interface de armazenamento e a reconstrução começou com êxito.

A orientação atual da IceWhale para o armazenamento diz o mesmo: substitua o disco com falha e deixe o ZimaOS orientar a reconstrução.

Utilize o fluxo atual de recuperação do armazenamento do ZimaOS.

Utilize um Disco de Substituição com Capacidade Igual ou Superior

O disco de substituição tem de ser suficientemente grande para cumprir a geometria dos membros do RAID. Dois discos comercializados com a mesma capacidade nominal podem diferir ligeiramente no número de setores utilizáveis, pelo que, sempre que possível, utilizar o mesmo modelo e capacidade reduz surpresas.

Monitorize o Progresso da Reconstrução e o Estado dos Discos

O ZimaOS 1.3.2 e versões posteriores adicionaram uma apresentação mais clara do progresso das operações de reconstrução e paridade do RAID. Durante a reconstrução, evite desligamentos desnecessários, monitorize as temperaturas e o estado SMART e, se possível, reduza as cargas de trabalho intensivas.

Verifique o Conjunto Depois da Recuperação

Quando a reconstrução terminar, confirme que:

  • o estado do RAID voltou a ser saudável;
  • todos os membros esperados estão ativos;
  • as partilhas e aplicações conseguem ler e escrever normalmente;
  • os ficheiros importantes abrem corretamente;
  • a sua cópia de segurança independente está atualizada.

O Segundo RAID 0 da Fonte Estar Só de Leitura Foi um Sintoma Separado

O utilizador referiu que ambos os conjuntos foram colocados em modo só de leitura, embora apenas o RAID 5 tivesse o disco danificado. A discussão não documentou por que motivo o RAID 0 não relacionado foi protegido dessa forma nem qual foi a ação exata que repôs o acesso de escrita.

Não assuma que um sistema ZimaOS atual irá sempre colocar todos os conjuntos em modo só de leitura após uma falha de RAID.

Perguntas Frequentes sobre a Recuperação de RAID 5

O utilizador da fonte conseguiu iniciar a reconstrução do RAID 5?

Sim. Depois de substituir o disco com falha e seguir as indicações, o conjunto entrou em recuperação com uma estimativa de cerca de 13,5 horas.

Devo executar primeiro comandos mdadm manualmente?

Não para o fluxo confirmado pela fonte. Utilize o processo de reconstrução gerido pelo ZimaOS, salvo indicação da assistência da IceWhale com instruções de linha de comandos específicas para a sua versão.

O RAID 5 é uma cópia de segurança?

Não. O RAID mantém a disponibilidade perante a falha de um disco; não protege contra eliminação acidental, corrupção, roubo ou outra falha durante a reconstrução.