Conservez environ 20 % d’espace libre dans un pool ZFS comme point de départ pratique. La règle familière des 80 % d’utilisation est une mesure de prudence, pas une limite brutale : la charge de travail, la configuration des vdev, la taille des enregistrements, la fragmentation et les blocs conservés par les instantanés déterminent le moment où les performances se dégradent réellement.
Les instantanés sont importants, car les blocs écrasés ou supprimés ne peuvent pas retourner dans l’espace libre tant qu’un instantané y fait encore référence. Un pool peut donc sembler stable jusqu’à ce qu’une réécriture importante, une réception de réplication ou une purge révèle le peu d’espace de travail restant. Cette distinction définit la méthode de mesure, la marge de sécurité et la condition d’arrêt. Cette distinction définit la méthode de mesure, la marge de sécurité et la condition d’arrêt.
Considérez une utilisation de 80 % comme un seuil d’intervention précoce
Lorsque l’utilisation est faible, ZFS dispose de davantage de possibilités pour allouer de nouveaux blocs. À mesure que le pool se remplit, les régions libres deviennent plus difficiles à trouver et les mises à jour en écriture à la copie peuvent nécessiter davantage de travail de la part de l’allocateur, en particulier sur les pools HDD fragmentés.
Commencez à agir sur la capacité lorsque l’utilisation approche 80 %, plutôt que d’attendre un manque d’espace. Le stockage de machines virtuelles soumis à de nombreuses écritures, les bases de données et les E/S aléatoires de petite taille nécessitent davantage de marge qu’une archive principalement séquentielle.
Effectuez les mesures au niveau du pool ainsi qu’au niveau du dataset. Les quotas et les réservations peuvent provoquer l’échec d’un dataset même lorsque le pool indique qu’il reste de l’espace libre, tandis que les instantanés peuvent retenir de l’espace que les outils de répertoire classiques n’affichent pas.
Surveillez les signaux qui révèlent une pression réelle
Suivez la capacité du pool, la fragmentation, la latence d’écriture, l’évolution de l’espace libre, l’espace utilisé par les instantanés ainsi que la taille des tâches de réplication ou de sauvegarde en attente. Un seul pourcentage ne peut pas décrire toutes ces contraintes.
Comparez la latence pendant la charge de travail normale à 70 %, 80 % et des niveaux d’utilisation supérieurs, si vous pouvez le faire en toute sécurité. Le véritable signal d’alerte est une hausse répétable de la latence ou une baisse du débit sous une charge identique.
Utilisez le tableau de décision ci-dessous pour traduire l’utilisation et le comportement en mesures concrètes.
| État observé | Verdict | Prochaine action |
|---|---|---|
| Moins de 70 % utilisés ; latence stable | Marge saine | Continuez à surveiller la tendance |
| Environ 80 % utilisés ou latence en hausse | Seuil d’intervention | Purge sécurisée, déplacement des données ou extension |
| Plus de 90 % utilisés ; allocations échouées | Critique | Arrêtez les écritures non essentielles et récupérez de l’espace |
Récupérez de la marge sans provoquer un second incident
Supprimez uniquement les instantanés situés en dehors de la période de conservation approuvée et vérifiez qu’ils ne sont pas nécessaires comme bases de réplication. La suppression d’un instantané commun récent peut forcer un renvoi complet nécessitant encore davantage d’espace.
Déplacez les données froides, étendez le pool avec une topologie prise en charge ou réduisez les écritures entrantes avant d’exécuter une maintenance lourde. Ne lancez pas simultanément un scrub, une reconstruction, une réception de réplication et une suppression massive sur un pool presque plein.
Le diagnostic de l’espace des instantanés de ZimaSpace sépare les instantanés, les corbeilles et les fichiers actifs.
L’analyse des instantanés OpenZFS de Klara Systems met en relation le remplissage du pool, l’utilisation des instantanés et la planification pratique de la capacité.
Retestez la charge de travail initiale après le nettoyage
Répétez la même charge de travail d’écriture, d’instantanés et de navigation dans les répertoires après avoir récupéré de l’espace. Comparez la latence, le débit et la pression exercée sur l’allocateur au lieu de supposer qu’un pourcentage inférieur a résolu le problème.
Vérifiez que le prochain cycle planifié d’instantanés et de réplication se termine correctement et que le pool ne revient pas immédiatement au seuil d’alerte. Configurez les alertes suffisamment tôt pour couvrir la croissance normale ainsi que la tâche temporaire la plus importante prévue.
Conservez un plancher de 20 % d’espace libre lorsque les mesures ne sont pas disponibles. Augmentez-le si la latence d’écriture augmente, si la fragmentation est élevée ou si une divergence importante des instantanés est habituelle ; arrêtez les nouvelles écritures si le pool approche de l’épuisement ou si les allocations commencent à échouer.
Assistance et conseils
Plus à lire

Quelle plage de température est acceptable pour un disque NVMe dans un mini-PC ?
Pour de nombreux SSD NVMe grand public, viser environ 30-50 °C au repos et moins de 70 °C en charge prolongée est une bonne...

Combien d’espace SSD un serveur multimédia doit-il réserver aux illustrations et au cache ?
Commencez par l’espace réellement utilisé par les données de l’application, puis prévoyez une marge de croissance de 50 à 100 % ; les miniatures...

Combien de clients SMB simultanés un NAS 1GbE peut-il servir confortablement ?
Un NAS 1GbE peut servir de nombreux clients légers, mais seulement quelques transferts lourds ; la limite pratique partagée est d’environ 100–115 Mo/s avant...

