Antes de outra tentativa de reparação RAID, trate cada ficheiro atualmente legível e cada membro original como evidência que pode não sobreviver à próxima reconstrução, verificação do sistema de ficheiros ou montagem forçada. Reduza escritas, documente o conjunto de membros, copie os dados de maior valor para um destino independente, verifique essa cópia e realize reconstruções posteriores a partir de imagens ou clones sempre que o estado do array for incerto.
Pausa Tudo o que Puder Mudar a Fonte
Pare aplicações, máquinas virtuais, transferências, indexação de media, trabalhos de backup, serviços de base de dados e partilhas de utilizadores que escrevam no volume afetado. Uma tentativa de reparação é mais difícil de avaliar quando cargas de trabalho normais continuam a alterar ficheiros, paridade, diários e carimbos temporais por baixo.
Não reinicie repetidamente só para ver se o array volta. Um reinício pode alterar nomes de dispositivos, limpar registos voláteis, desencadear montagem automática ou iniciar uma reconstrução em segundo plano. Preserve o estado atual antes de testar outra hipótese.
Registe a Topologia de Armazenamento Antes de a Tocar
Crie um mapa dos membros que ligue cada baía física a um número de série, porta do controlador, nome atual do dispositivo, função no RAID e estado de saúde. Guarde o nível RAID, definições de stripe ou chunk, UUID do array, ordem dos membros, contagens de eventos, progresso da reconstrução e o primeiro erro detetado.
Exporte também os registos do controlador, kernel, sistema de ficheiros e SMART. O membro que parece pior agora pode não ser o que falhou primeiro. Uma tentativa de recuperação posterior precisa de evidências suficientes para distinguir um disco obsoleto, um disco a falhar recentemente e um caminho de ligação defeituoso.
Copie Primeiro os Ficheiros Legíveis Mais Valiosos
Quando o sistema de ficheiros for legível e os membros não estiverem a deteriorar-se, assegure os ficheiros utilizáveis antes de executar uma operação longa de volume completo. Uma discussão técnica descreve um limiar prático: copie primeiro os dados legíveis e mude para a clonagem quando surgirem erros de cópia. Comece com documentos, fotos, ficheiros de projeto, bases de dados de aplicações, chaves de encriptação e exportações de configuração que não podem ser recriadas.
Copie para um limite físico de armazenamento diferente. Não mova ficheiros, não apague os originais após copiar, nem escreva dados recuperados de volta para o array afetado. Mantenha um manifesto contendo o caminho de origem, caminho de destino, tamanho do ficheiro, carimbo temporal e resultado da cópia.
Verifique a Cópia Antes de Assumir que Está Segura
Uma cópia concluída ainda pode conter ficheiros ilegíveis, caminhos ignorados ou dados danificados. Compare o número de ficheiros e o total de bytes, registe os caminhos falhados, abra ficheiros representativos e utilize somas de verificação para itens críticos sempre que possível.
Mantenha o destino da cópia em modo só de leitura ou desligado após a verificação. Se a próxima reparação danificar a fonte, a cópia protegida deve permanecer independente do processo de reparação e de qualquer tarefa de sincronização.
Escolha entre cópia de ficheiros e criação de imagem dos membros
| Condição atual | Ação preferida inicial | Razão |
|---|---|---|
| Sistema de ficheiros estável e ficheiros críticos legíveis | Copie primeiro os ficheiros de maior valor | Forma mais rápida de garantir dados úteis |
| O sistema de ficheiros não monta mas os membros são lidos de forma fiável | Faça a imagem ou clone de cada membro | Preserva a geometria do array para reconstrução offline |
| Um membro tem erros de leitura mas o volume ainda abre | Copie ficheiros críticos, depois faça a imagem com tentativas controladas | Uma verificação completa pode piorar o dispositivo fraco |
| Dois ou mais membros estão instáveis | Desligue a alimentação e use recuperação baseada em imagem primeiro | Outra reconstrução pode exceder a tolerância a falhas restante |
| A ordem dos discos ou a geometria do RAID é incerta | Não crie nem inicialize um array | Metadados novos podem sobrescrever as pistas necessárias para a sua reconstrução |
A escolha é determinada pela estabilidade da fonte e não por uma sequência universal. Os profissionais de recuperação distinguem entre extração direta de um disco estável e criação controlada de imagens de um disco instável, porque uma leitura em massa pode colocar stress adicional no hardware marginal.
Faça a imagem dos membros originais antes de testes destrutivos
Quando o acesso normal aos ficheiros estiver incompleto ou o array já tiver falhado numa reparação, crie imagens a nível de setor ou clones dos membros originais. A razão é realizar trabalho intensivo de recuperação numa imagem do disco em vez da fonte danificada. Identifique cada imagem com o número de série da fonte e a posição na baía, e preserve os originais inalterados.
Execute reparações apenas num conjunto de trabalho reversível
Teste a montagem do array, verificações do sistema de ficheiros, reparação de metadados ou software de recuperação de dados em cópias sempre que possível. Um exemplo de recuperação recomenda que faça uma imagem antes de executar a reparação do sistema de ficheiros e trabalhe nessa imagem. Monte primeiro um volume reconstruído em modo só de leitura e escreva os ficheiros extraídos para um destino separado.
Registe cada alteração ao conjunto de trabalho. Se um teste usar uma ordem diferente de membros, tamanho de stripe, offset ou rotação de paridade, crie uma nova cópia de trabalho em vez de sobrescrever a única reconstrução que produziu dados legíveis.
Evite Ações Que Reescrevem as Evidências
As ações que criam novos metadados não são diagnósticos neutros. A orientação profissional para recuperação RAID alerta especificamente contra inicializar membros, executar reparação do sistema de ficheiros com permissão de escrita ou iniciar uma reconstrução incerta porque cada uma pode substituir evidências que uma reconstrução posterior necessita.
- Não inicialize um novo RAID com os membros originais.
- Não execute uma reparação do sistema de ficheiros com permissão de escrita apenas porque o volume não monta.
- Não volte a adicionar um disco obsoleto até que o conjunto de membros autorizado seja conhecido.
- Não limpe uma configuração estrangeira antes de guardar os metadados do controlador e dos membros.
- Não reinicie repetidamente uma reconstrução que falha na mesma faixa.
- Não guarde ficheiros recuperados no array que está a ser recuperado.
Se a reconstrução atual ainda estiver a decorrer enquanto o número de erros aumenta, siga o fluxo de trabalho mais seguro para uma reconstrução RAID com erros de I/O crescentes antes de decidir se continua, copia, faz a imagem ou para.
Perguntas Frequentes
Deve copiar ficheiros ou fazer a imagem dos discos primeiro?
Copie primeiro os ficheiros críticos quando o sistema de ficheiros estiver estável e os discos não estiverem a deteriorar-se. Faça a imagem primeiro quando o sistema de ficheiros não estiver disponível, a geometria RAID for incerta, uma reparação já tiver falhado ou leituras repetidas puderem piorar um membro marginal.
Deve continuar a copiar quando surgirem erros de leitura?
Continue apenas quando os erros forem limitados, estáveis e os ficheiros de maior valor ainda estiverem a ser recuperados. Se os erros aumentarem, o disco se desligar ou a mesma região travar repetidamente, pare a cópia normal e passe para a criação controlada de imagens ou recuperação profissional.
Quando deve o NAS ser desligado?
Desligue quando múltiplos membros estiverem instáveis, uma ressincronização inexplicada estiver a escrever nos originais, os discos estiverem a fazer cliques ou a desligar-se, ou os dados forem insubstituíveis e a próxima ação não for totalmente compreendida.
O Objetivo da Proteção
A próxima reparação nunca deve ser o único caminho restante para os dados. Proteja os ficheiros legíveis, preserve as imagens dos membros e verifique primeiro uma cópia independente. Uma vez que o estado original possa ser restaurado, a reparação torna-se um experimento em vez de uma aposta sem retorno.
Suporte e Dicas
Mais para Ler

O Plex pode partilhar uma GPU com outro contentor Docker?
O Plex e outro contentor conseguem frequentemente aceder à mesma GPU, mas é necessário testar o suporte dos controladores, o mapeamento de dispositivos, a...

Como saber se um erro do Plex vem do cliente ou do servidor
Reproduza o mesmo item noutro cliente, compare o percurso da sessão e, em seguida, recolha provas do servidor apenas depois de o âmbito lhe...

Como configurar a cache do Plex e o armazenamento temporário de transcodificação
Proteja o estado persistente do Plex enquanto coloca os ficheiros temporários de transcodificação num armazenamento local adequado e, em seguida, verifique a limpeza, o...

