Comment protéger les données lisibles avant une nouvelle tentative de réparation RAID

Eva Wong est la rédactrice technique et bricoleuse résidente chez ZimaSpace. Geek depuis toujours, passionnée par les homelabs et les logiciels open source, elle se spécialise dans la traduction de concepts techniques complexes en guides accessibles et pratiques. Eva croit que l’auto-hébergement doit être amusant, pas intimidant. À travers ses tutoriels, elle donne à la communauté les moyens de démystifier les configurations matérielles, depuis la construction de leur premier NAS jusqu’à la maîtrise des conteneurs Docker.

Avant une nouvelle tentative de réparation RAID, considérez chaque fichier actuellement lisible et chaque membre original comme une preuve qui pourrait ne pas survivre à la prochaine reconstruction, vérification du système de fichiers ou assemblage forcé. Réduisez les écritures, documentez l’ensemble des membres, copiez les données de plus grande valeur vers une destination indépendante, vérifiez cette copie et effectuez une reconstruction ultérieure à partir d’images ou de clones chaque fois que l’état du tableau est incertain.

Mettez en pause tout ce qui peut modifier la source

Arrêtez les applications, machines virtuelles, téléchargements, indexation multimédia, tâches de sauvegarde, services de base de données et partages utilisateurs qui écrivent sur le volume affecté. Une tentative de réparation est plus difficile à évaluer lorsque les charges de travail ordinaires continuent de modifier les fichiers, la parité, les journaux et les horodatages en dessous.

Ne redémarrez pas plusieurs fois juste pour voir si le tableau revient. Un redémarrage peut changer les noms des appareils, effacer les journaux volatils, déclencher un assemblage automatique ou lancer une reconstruction en arrière-plan. Préservez l’état actuel avant de tester une autre hypothèse.

Enregistrez la topologie de stockage avant de la manipuler

Créez une carte des membres qui relie chaque baie physique à un numéro de série, un port de contrôleur, un nom d’appareil actuel, un rôle RAID et un état de santé. Enregistrez le niveau RAID, les paramètres de bande ou de segment, l’UUID du tableau, l’ordre des membres, le nombre d’événements, la progression de la reconstruction et la première erreur observée.

Exportez également les journaux du contrôleur, du noyau, du système de fichiers et SMART. Le membre qui semble le plus endommagé maintenant n’est peut-être pas celui qui a échoué en premier. Une tentative de récupération ultérieure nécessite suffisamment de preuves pour distinguer un disque obsolète, un disque en défaillance récente et un chemin de connexion défectueux.

Copiez d’abord les fichiers lisibles les plus précieux

Lorsque le système de fichiers est lisible et que les membres ne se détériorent pas, sécurisez les fichiers utilisables avant d’exécuter une opération longue sur tout le volume. Une discussion technique décrit un seuil pratique : copiez d’abord les données lisibles et passez au clonage lorsque des erreurs de copie apparaissent. Commencez par les documents, photos, fichiers de projet, bases de données d’applications, clés de chiffrement et exportations de configuration qui ne peuvent pas être recréés.

Copiez vers une autre limite de stockage physique. Ne déplacez pas les fichiers, ne supprimez pas les originaux après la copie, et n’écrivez pas les données récupérées sur le tableau affecté. Conservez un manifeste contenant le chemin source, le chemin de destination, la taille du fichier, l’horodatage et le résultat de la copie.

Vérifiez la copie avant de supposer qu’elle est sûre

Une copie terminée peut encore contenir des fichiers illisibles, des chemins ignorés ou des données endommagées. Comparez le nombre de fichiers et le total des octets, enregistrez les chemins échoués, ouvrez des fichiers représentatifs et utilisez des sommes de contrôle pour les éléments critiques lorsque c’est possible.

Gardez la destination de la copie en lecture seule ou déconnectée après vérification. Si la réparation suivante endommage la source, la copie protégée doit rester indépendante du processus de réparation et de toute tâche de synchronisation.

Choisissez entre la copie de fichiers et l'imagerie des membres

Condition actuelle Action préférée en premier Raison
Système de fichiers stable et fichiers critiques lisibles Copiez d'abord les fichiers de plus grande valeur La méthode la plus rapide pour sécuriser les données utiles
Le système de fichiers ne se monte pas mais les membres se lisent de manière fiable Imagez ou clonez chaque membre Préserve la géométrie du tableau pour une reconstruction hors ligne
Un membre présente des erreurs de lecture mais le volume s'ouvre encore Copiez les fichiers critiques, puis imagez avec des tentatives contrôlées Un scan complet pourrait aggraver l'état du périphérique faible
Deux membres ou plus sont instables Éteignez et utilisez une récupération basée sur l'image en premier Une autre reconstruction pourrait dépasser la tolérance aux pannes restante
L'ordre des disques ou la géométrie RAID est incertaine Ne créez pas et n'initialisez pas un tableau De nouvelles métadonnées peuvent écraser les indices nécessaires à leur reconstruction

Le choix est dicté par la stabilité de la source plutôt que par une séquence universelle. Les praticiens de la récupération distinguent entre l'extraction directe d'un disque stable et l'imagerie contrôlée d'un disque instable, car une lecture en masse peut exercer une pression supplémentaire sur un matériel fragile.

Imagez les membres originaux avant les tests destructifs

Lorsque l'accès normal aux fichiers est incomplet ou que le tableau a déjà échoué à une réparation, créez des images ou clones au niveau des secteurs des membres originaux. La raison est de réaliser un travail intensif de récupération sur une image disque plutôt que sur la source endommagée. Étiquetez chaque image avec le numéro de série de la source et la position dans la baie, et conservez les originaux inchangés.

Effectuez les réparations uniquement sur un ensemble de travail réversible

Testez l'assemblage du tableau, les vérifications du système de fichiers, la réparation des métadonnées ou les logiciels de récupération de données sur des copies chaque fois que possible. Un exemple de récupération recommande de faire une image avant d'exécuter une réparation du système de fichiers et de travailler sur cette image. Montez d'abord un volume reconstruit en lecture seule et écrivez les fichiers extraits vers une destination séparée.

Enregistrez chaque changement apporté à l'ensemble de travail. Si un test utilise un ordre de membres différent, une taille de bande différente, un décalage ou une rotation de parité, créez une nouvelle copie de travail plutôt que d'écraser la seule reconstruction qui a produit des données lisibles.

Évitez les actions qui réécrivent les preuves

Les actions qui créent de nouvelles métadonnées ne sont pas des diagnostics neutres. Les conseils professionnels de récupération RAID avertissent spécifiquement contre l'initialisation des membres, la réparation du système de fichiers en mode écriture ou le démarrage d'une reconstruction incertaine car chacune peut remplacer des preuves dont une reconstruction ultérieure a besoin.

  • N'initialisez pas un nouveau RAID avec les membres originaux.
  • Ne lancez pas une réparation du système de fichiers en mode écriture simplement parce que le volume ne monte pas.
  • Ne réintégrez pas un disque obsolète tant que l'ensemble des membres autoritaires n'est pas connu.
  • Ne supprimez pas une configuration étrangère avant de sauvegarder les métadonnées du contrôleur et des membres.
  • Ne redémarrez pas une reconstruction qui échoue toujours sur la même plage.
  • Ne sauvegardez pas les fichiers récupérés sur le volume en cours de récupération.

Si la reconstruction en cours est toujours en cours alors que le nombre d'erreurs augmente, suivez le flux de travail plus sûr pour une reconstruction RAID avec des erreurs d'E/S croissantes avant de décider de continuer, copier, imager ou arrêter.

FAQ

Faut-il copier les fichiers ou faire une image des disques en premier ?

Copiez d'abord les fichiers critiques lorsque le système de fichiers est stable et que les disques ne se détériorent pas. Faites une image d'abord lorsque le système de fichiers est indisponible, que la géométrie RAID est incertaine, qu'une réparation a déjà échoué, ou que des lectures répétées pourraient aggraver un membre marginal.

Faut-il continuer à copier lorsque des erreurs de lecture apparaissent ?

Continuez uniquement lorsque les erreurs sont limitées, stables, et que les fichiers de plus grande valeur sont encore récupérés. Si les erreurs augmentent, si le disque se déconnecte ou si la même zone bloque à plusieurs reprises, arrêtez la copie ordinaire et passez à l'imagerie contrôlée ou à la récupération professionnelle.

Quand faut-il éteindre le NAS ?

Éteignez lorsque plusieurs membres sont instables, qu'une resynchronisation inexpliquée écrit sur les originaux, que les disques cliquettent ou se déconnectent, ou que les données sont irremplaçables et que la prochaine action n'est pas entièrement comprise.

L'objectif de protection

La prochaine réparation ne doit jamais être la seule voie restante vers les données. Sécurisez les fichiers lisibles, préservez les images des membres et vérifiez d'abord une copie indépendante. Une fois que l'état original peut être restauré, la réparation devient une expérience plutôt qu'un pari sans retour.

Assistance et conseils

Plus à lire

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.