Porque é que uma unidade pode indicar SMART PASSED, mas falhar no mesmo LBA durante um teste de leitura completo?

Eva Wong é a Redatora Técnica e e entusiasta residente na ZimaSpace. Uma geek de longa data com paixão por homelabs e software de código aberto, ela é especialista em traduzir conceitos técnicos complexos em guias acessíveis e práticos . Eva acredita que o auto-hospedagem deve ser divertida, não intimidante. Através dos seus tutoriais, ela capacita a comunidade adesmistificar configurações de hardware , desde a construção do seu primeiro NAS até dominar os contêineres Docker., from building their first NAS to mastering Docker containers.

Uma unidade pode indicar SMART PASSED e, ainda assim, falhar numa leitura completa, porque o limiar geral de integridade não garante que todos os sectores continuem legíveis.

A linha de integridade geral do SMART resume os limiares de falha definidos pelo fabricante; não significa que toda a superfície tenha sido lida durante essa verificação. Um teste de leitura completa acede a muito mais endereços e pode revelar um sector localizado incorrigível, uma cabeça de leitura fraca, uma região de memória flash marginal, um tempo limite excedido, um problema no cabo ou uma reinicialização do controlador. A evidência mais útil é verificar se a falha se repete no mesmo LBA e se acompanha a unidade quando o caminho de ligação é alterado.

Separe a Integridade Geral do SMART dos Resultados dos Autotestes

Guarde o relatório SMART completo, não apenas a linha final PASSED. Inclua atributos, registos de erros, histórico de autotestes, sectores pendentes, sectores incorrigíveis, erros CRC e temperatura.

O Smartmontools indica que uma unidade pode manter o estado SMART PASSED após um autoteste falhado quando um sector corrompido ou incorrigível ainda não ultrapassou o limiar geral de falha definido pelo fabricante.

Se o registo do autoteste já apresentar um LBA com falha, preserve-o antes de executar mais testes. O resultado de integridade geral não deve sobrepor-se a evidências específicas do suporte ou do teste.

Compreenda o Que um Teste de Leitura Completa Acrescenta

Registe a ferramenta de teste, o modo de leitura, o tamanho do bloco, o LBA inicial, o LBA final, o tempo decorrido e se tenta novamente as leituras falhadas. Confirme que o teste é apenas de leitura.

A Seagate explica que o seu Long Generic lê cada sector, razão pela qual pode encontrar um problema localizado que uma verificação de integridade curta não detetou.

Uma falha de leitura completa é mais útil para diagnóstico quando ocorre repetidamente no mesmo endereço. Uma falha que muda de endereço ou surge apenas através de uma caixa externa pode indicar instabilidade no transporte, na alimentação ou no controlador.

Compare com um Segundo Teste Alargado do Fabricante

Quando a unidade estiver suficientemente estável e os dados estiverem protegidos, execute o diagnóstico alargado ou a verificação do suporte recomendada pelo fabricante. Guarde o código e o registo.

A Western Digital descreve um teste alargado como um teste completo da unidade, tornando-o útil para confirmar que uma falha de leitura genérica não é apenas uma particularidade de um utilitário específico.

Não submeta repetidamente a testes intensivos uma unidade que contenha a única cópia de dados importantes. Quando os erros estão a aumentar, criar uma imagem das regiões legíveis é mais seguro do que recolher mais confirmações.

-15% OFF

Associe o LBA com Falha aos Próprios Registos da Unidade

Compare o endereço da falha de leitura completa com o registo de autotestes SMART, o registo de erros ATA, as alterações nos sectores pendentes e os erros de E/S do sistema. Registe se o mesmo LBA ou uma área próxima aparece repetidamente.

A referência do smartctl no Debian documenta os resultados dos autotestes e dos registos de erros, que podem preservar o primeiro endereço de bloco lógico com falha.

Um endereço repetível aponta para danos localizados no suporte. Endereços aleatórios combinados com erros CRC, reinicializações da ligação ou desaparecimento do dispositivo apontam para o caminho de ligação ou para o controlador.

Utilize um Teste de Superfície Apenas de Leitura com Cuidado

Verifique se a ferramenta escolhida está no modo apenas de leitura e se acede ao dispositivo correto. Nunca utilize um teste destrutivo com padrões de escrita num disco que contenha dados necessários.

O manual do badblocks distingue a verificação apenas de leitura dos modos destrutivos de escrita, o que é essencial antes de testar um disco com dados.

Uma verificação da superfície não é uma reparação. É uma medição da legibilidade nas condições atuais, e novas tentativas repetidas podem aumentar o esforço imposto a uma unidade em falha.

Separe a Falha do Suporte da Falha do Cabo, da Alimentação ou do Controlador

Depois de proteger os dados, repita uma leitura curta e limitada em torno da área com falha através de um cabo comprovadamente funcional, de uma porta direta, de um caminho de alimentação estável e, quando for prático, de outro controlador.

O GNU ddrescue foi concebido para recuperar primeiro as regiões legíveis enquanto regista o progresso, o que é mais seguro do que reiniciar repetidamente uma leitura completa normal contra um disco instável.

Se o mesmo LBA falhar através de caminhos comprovadamente funcionais, a unidade é o componente comum. Se a falha desaparecer ou mudar com o caminho, verifique a alimentação, o cabo, a ponte, o HBA e os registos do sistema anfitrião.

Proteja os Dados Antes de Decidir se Deve Substituir a Unidade

Pare os testes desnecessários quando os erros aumentarem, o dispositivo for reinicializado, os contadores SMART de sectores pendentes ou incorrigíveis subirem, ou a unidade contiver dados insubstituíveis. Copie ou crie primeiro uma imagem dos dados legíveis.

O guia da ZimaSpace sobre um cabo SATA defeituoso versus uma unidade NAS em falha aborda a decisão adjacente de isolar o caminho; este artigo centra-se na razão pela qual SMART PASSED e o resultado de uma verificação de toda a superfície podem divergir.

A unidade deve deixar de prestar serviço principal quando persistirem regiões ilegíveis repetíveis, testes alargados falhados, registos do dispositivo em deterioração ou erros que acompanham o número de série, depois de o caminho de ligação ter sido controlado.

Perguntas Frequentes

SMART PASSED significa que uma unidade está saudável?

Significa que a unidade ainda não ultrapassou o limiar geral de falha definido pelo fabricante. Não garante que todos os LBA sejam legíveis nem que não exista uma falha eletrónica ou de transporte intermitente.

Um teste de leitura completa é destrutivo?

Uma verificação apenas de leitura não se destina a modificar os dados, mas pode sobrecarregar uma unidade fraca. Os testes de superfície com padrões de escrita são destrutivos e nunca devem ser utilizados em dados necessários.

Devo tentar ler novamente o mesmo sector com falha muitas vezes?

Não. As tentativas repetidas podem desperdiçar tempo e sobrecarregar um suporte instável. Preserve o primeiro erro, proteja os dados legíveis e utilize uma ferramenta orientada para a recuperação quando os dados forem importantes.

Suporte e Dicas

Mais para Ler

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.