De combien d’espace libre ZFS doit-il disposer avant que les performances des instantanés ne se dégradent ?

Eva Wong est la rédactrice technique et bricoleuse résidente chez ZimaSpace. Geek depuis toujours, passionnée par les homelabs et les logiciels open source, elle se spécialise dans la traduction de concepts techniques complexes en guides accessibles et pratiques. Eva croit que l’auto-hébergement doit être amusant, pas intimidant. À travers ses tutoriels, elle donne à la communauté les moyens de démystifier les configurations matérielles, depuis la construction de leur premier NAS jusqu’à la maîtrise des conteneurs Docker.

Conservez environ 20 % d’espace libre dans un pool ZFS comme point de départ pratique. La règle familière des 80 % d’utilisation est une mesure de prudence, pas une limite brutale : la charge de travail, la configuration des vdev, la taille des enregistrements, la fragmentation et les blocs conservés par les instantanés déterminent le moment où les performances se dégradent réellement.

Les instantanés sont importants, car les blocs écrasés ou supprimés ne peuvent pas retourner dans l’espace libre tant qu’un instantané y fait encore référence. Un pool peut donc sembler stable jusqu’à ce qu’une réécriture importante, une réception de réplication ou une purge révèle le peu d’espace de travail restant. Cette distinction définit la méthode de mesure, la marge de sécurité et la condition d’arrêt. Cette distinction définit la méthode de mesure, la marge de sécurité et la condition d’arrêt.

Considérez une utilisation de 80 % comme un seuil d’intervention précoce

Lorsque l’utilisation est faible, ZFS dispose de davantage de possibilités pour allouer de nouveaux blocs. À mesure que le pool se remplit, les régions libres deviennent plus difficiles à trouver et les mises à jour en écriture à la copie peuvent nécessiter davantage de travail de la part de l’allocateur, en particulier sur les pools HDD fragmentés.

Commencez à agir sur la capacité lorsque l’utilisation approche 80 %, plutôt que d’attendre un manque d’espace. Le stockage de machines virtuelles soumis à de nombreuses écritures, les bases de données et les E/S aléatoires de petite taille nécessitent davantage de marge qu’une archive principalement séquentielle.

Effectuez les mesures au niveau du pool ainsi qu’au niveau du dataset. Les quotas et les réservations peuvent provoquer l’échec d’un dataset même lorsque le pool indique qu’il reste de l’espace libre, tandis que les instantanés peuvent retenir de l’espace que les outils de répertoire classiques n’affichent pas.

Surveillez les signaux qui révèlent une pression réelle

Suivez la capacité du pool, la fragmentation, la latence d’écriture, l’évolution de l’espace libre, l’espace utilisé par les instantanés ainsi que la taille des tâches de réplication ou de sauvegarde en attente. Un seul pourcentage ne peut pas décrire toutes ces contraintes.

Comparez la latence pendant la charge de travail normale à 70 %, 80 % et des niveaux d’utilisation supérieurs, si vous pouvez le faire en toute sécurité. Le véritable signal d’alerte est une hausse répétable de la latence ou une baisse du débit sous une charge identique.

Utilisez le tableau de décision ci-dessous pour traduire l’utilisation et le comportement en mesures concrètes.

État observé Verdict Prochaine action
Moins de 70 % utilisés ; latence stable Marge saine Continuez à surveiller la tendance
Environ 80 % utilisés ou latence en hausse Seuil d’intervention Purge sécurisée, déplacement des données ou extension
Plus de 90 % utilisés ; allocations échouées Critique Arrêtez les écritures non essentielles et récupérez de l’espace

Récupérez de la marge sans provoquer un second incident

Supprimez uniquement les instantanés situés en dehors de la période de conservation approuvée et vérifiez qu’ils ne sont pas nécessaires comme bases de réplication. La suppression d’un instantané commun récent peut forcer un renvoi complet nécessitant encore davantage d’espace.

Déplacez les données froides, étendez le pool avec une topologie prise en charge ou réduisez les écritures entrantes avant d’exécuter une maintenance lourde. Ne lancez pas simultanément un scrub, une reconstruction, une réception de réplication et une suppression massive sur un pool presque plein.

Le diagnostic de l’espace des instantanés de ZimaSpace sépare les instantanés, les corbeilles et les fichiers actifs.

L’analyse des instantanés OpenZFS de Klara Systems met en relation le remplissage du pool, l’utilisation des instantanés et la planification pratique de la capacité.

-15% OFF

Retestez la charge de travail initiale après le nettoyage

Répétez la même charge de travail d’écriture, d’instantanés et de navigation dans les répertoires après avoir récupéré de l’espace. Comparez la latence, le débit et la pression exercée sur l’allocateur au lieu de supposer qu’un pourcentage inférieur a résolu le problème.

Vérifiez que le prochain cycle planifié d’instantanés et de réplication se termine correctement et que le pool ne revient pas immédiatement au seuil d’alerte. Configurez les alertes suffisamment tôt pour couvrir la croissance normale ainsi que la tâche temporaire la plus importante prévue.

Conservez un plancher de 20 % d’espace libre lorsque les mesures ne sont pas disponibles. Augmentez-le si la latence d’écriture augmente, si la fragmentation est élevée ou si une divergence importante des instantanés est habituelle ; arrêtez les nouvelles écritures si le pool approche de l’épuisement ou si les allocations commencent à échouer.

Assistance et conseils

Plus à lire

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.