Solution communautaire

Migration des données ZimaOS bloquée : vérifiez d’abord la resynchronisation RAID

A data-location migration remained at 6% while a newly created RAID1 was still performing a very slow background resync.

Si la migration des données de ZimaOS semble bloquée à un faible pourcentage pendant que vous déplacez des données vers un RAID nouvellement créé, vérifiez d’abord la reconstruction RAID et évitez d’interrompre aveuglément la migration. L’interface de migration peut sembler figée alors que la couche de stockage poursuit sa resynchronisation en arrière-plan.

Dans le cas source, la migration restait à 6 % et l’interface web devenait difficile à utiliser, mais Exécutez : montrait que la grappe RAID1 n’avait effectué qu’environ la moitié d’une resynchronisation très lente. Il s’agit d’une charge de travail de stockage, et non d’une preuve que la tâche de migration elle-même a planté.

Pourquoi la migration des données peut sembler bloquée pendant une resynchronisation RAID

La création ou la reconstruction d’une grappe RAID entraîne des lectures et des écritures soutenues sur les disques qui la composent. Si vous lancez une migration de données volumineuse en même temps, les deux opérations se disputent la bande passante des disques et la latence des entrées-sorties.

Le guide actuel de migration des données de ZimaOS précise que la migration monopolise l’interface pendant son exécution et déplace des catégories entières telles que les images Docker, les données des applications Docker et les dossiers utilisateur. Les opérations volumineuses peuvent donc prendre bien plus de temps que l’estimation affichée par l’interface lorsque la grappe de destination est sollicitée.

Étape 1 : vérifiez l’état de la reconstruction RAID depuis le terminal

cat /proc/mdstat

Exécutez :

Pour un RAID md Linux, recherchez des termes tels que resynchronisation, récupération, ou un pourcentage de progression. Un RAID1 sain à deux disques affiche généralement ses deux membres comme [UU]. Si une resynchronisation est active, notez le pourcentage, l’heure de fin estimée et la vitesse.

Ce que signifie une estimation de temps restante très longue

Une estimation de temps restante élevée peut être due à des disques lents, à des problèmes de liaison USB/SATA, à des charges concurrentes ou à une resynchronisation md volontairement limitée. Cela ne signifie pas en soi que la grappe est défaillante. Vérifiez à nouveau après 10 à 30 minutes et assurez-vous que le pourcentage progresse.

Étape 2 : vérifiez que le système effectue toujours un travail utile

Si /proc/mdstat progresse au fil du temps, la couche de stockage fonctionne. Vous n’avez pas besoin d’installer iotop juste pour le prouver. ZimaOS est un système d’exploitation de type appliance ; l’ajout de paquets hôtes avec les méthodes classiques d’une distribution n’est donc pas l’approche de dépannage recommandée.

Vous pouvez également vérifier si les fichiers restent accessibles depuis un autre client. Dans le cas source, l’accès aux données depuis un ordinateur et l’application mobile fonctionnait toujours, même lorsque l’écran de migration web restait bloqué à 6 %.

Étape 3 : n’arrêtez pas Docker et n’interrompez pas la migration en premier

Arrêter Docker peut supprimer des services dont dépend l’interface web de ZimaOS, ce qui peut dégrader l’apparence du système tout en laissant l’opération de stockage irrésolue. Interrompre une migration en cours de copie peut également laisser certaines catégories à l’ancien emplacement et d’autres au nouveau.

Attendez la fin de la récupération RAID active, sauf si la progression de la baie s’est complètement arrêtée ou si les disques présentent des erreurs matérielles évidentes.

Quand devez-vous soupçonner que la migration est réellement bloquée ?

Approfondissez l’analyse si toutes ces conditions restent réunies pendant une période prolongée :

  • le pourcentage de migration ne change pas ;
  • /proc/mdstat n’indique aucune reconstruction active ou son pourcentage ne progresse jamais ;
  • l’activité des disques est pratiquement inexistante ;
  • la destination dispose de suffisamment d’espace libre ;
  • il n’y a aucune interruption évidente du réseau ou de l’alimentation.

À ce stade, recueillez la version exacte de ZimaOS, les types de stockage source et destination, la catégorie de migration, l’état du RAID et tous les journaux pertinents avant de redémarrer.

Utiliser le flux de travail actuel de migration des données

Dans la version actuelle de ZimaOS, cette fonctionnalité se trouve sous Paramètres → Migration des données. L’outil peut déplacer les images Docker, les données des applications Docker et les dossiers utilisateur au niveau des catégories. Si vous devez déplacer une seule application, utilisez le flux de travail des chemins de stockage de l’application au lieu de migrer toutes les applications ensemble.

Le guide de migration des données explique en quoi la migration gérée diffère du déplacement manuel de dossiers.

Comment éviter le même problème la prochaine fois

Laissez un RAID nouvellement créé terminer sa synchronisation avant de lancer une migration importante de données d’application ou de données utilisateur. Vérifiez que la destination est saine et dispose de suffisamment d’espace libre, puis migrez une catégorie à la fois. Cela réduit les E/S concurrentes et facilite l’identification des défaillances.

Conservez également une sauvegarde à jour des données irremplaçables. La synchronisation RAID et la migration des données sont toutes deux des opérations de stockage ; aucune ne doit être considérée comme une sauvegarde.

FAQ

Puis-je redémarrer ZimaOS si la migration des données reste bloquée à 6 % ?

Pas comme première étape. Vérifiez d’abord l’activité du RAID et du stockage. Si la baie est en cours de resynchronisation, laissez-la se terminer, sauf en cas de problème matériel ou de raison de sécurité justifiant son arrêt.

Pourquoi l’estimation de la migration indique-t-elle quelques minutes alors qu’elle prend des heures ?

L’estimation ne peut pas tenir pleinement compte d’une reconstruction RAID lente, de disques fortement sollicités ou d’un grand nombre de petits fichiers. Mesurez la progression réelle au lieu de vous fier à l’estimation initiale.

[UU] signifie-t-il que le RAID1 est sain ?

Pour un RAID1 md à deux membres, [UU] signifie que les deux membres attendus sont présents. Cela ne signifie pas qu’une resynchronisation est déjà terminée ; vérifiez donc également la ligne de progression.

Dois-je installer iotop sur ZimaOS ?

Généralement pas pour ce diagnostic. /proc/mdstat indique déjà si le RAID logiciel md est en cours de reconstruction, et éviter les modifications inutiles des paquets de l’hôte simplifie le dépannage.