Mantén aproximadamente un 20 % del pool ZFS libre como punto de partida práctico. La conocida regla del 80 % de uso es una medida preventiva, no un precipicio: la carga de trabajo, la disposición de los vdev, el tamaño de registro, la fragmentación y los bloques retenidos por las instantáneas determinan cuándo se degrada realmente el rendimiento.
Las instantáneas importan porque los bloques sobrescritos o eliminados no pueden volver al espacio libre mientras una instantánea siga haciendo referencia a ellos. Por lo tanto, un pool puede parecer estable hasta que una reescritura grande, una recepción de replicación o una depuración revelan lo poco que queda de espacio de trabajo. Esta distinción determina el método de medición, el margen de seguridad y la condición de parada. Esta distinción determina el método de medición, el margen de seguridad y la condición de parada.
Considera el 80 % de utilización como un umbral para actuar pronto
Con una utilización baja, ZFS tiene más opciones para asignar bloques nuevos. A medida que el pool se llena, resulta más difícil encontrar regiones libres y las actualizaciones de copia al escribir pueden requerir más trabajo del asignador, especialmente en pools de HDD fragmentados.
Empieza a tomar medidas cerca del 80 % de uso en lugar de esperar a que se produzca un evento de falta de espacio. El almacenamiento de máquinas virtuales con muchas escrituras, las bases de datos y las operaciones de E/S aleatorias pequeñas necesitan más margen que un archivo con operaciones mayormente secuenciales.
Mide tanto a nivel del pool como del dataset. Las cuotas y las reservas pueden hacer que un dataset falle aunque el pool informe de espacio libre, mientras que las instantáneas pueden ocupar espacio que las herramientas de directorio habituales no muestran.
Observa las señales que revelan una presión real
Controla la capacidad del pool, la fragmentación, la latencia de escritura, la tendencia del espacio libre, el espacio usado por las instantáneas y el tamaño de los trabajos de replicación o copia de seguridad pendientes. Un solo porcentaje no puede describir todas estas limitaciones.
Compara la latencia durante la carga de trabajo normal al 70 %, 80 % y niveles de utilización superiores, si puedes hacerlo de forma segura. La advertencia significativa es un aumento repetible de la latencia o una disminución del rendimiento con la misma carga.
Usa la siguiente tabla de decisiones para convertir la utilización y el comportamiento en acciones.
| Estado observado | Veredicto | Siguiente acción |
|---|---|---|
| Menos del 70 % de uso; latencia estable | Buen margen disponible | Continúa supervisando la tendencia |
| Alrededor del 80 % de uso o aumento de la latencia | Umbral de actuación | Depura de forma segura, mueve datos o amplía |
| Más del 90 % de uso; asignaciones fallidas | Crítico | Detén las escrituras no esenciales y recupera espacio |
Recupera margen sin crear un segundo incidente
Elimina únicamente las instantáneas que estén fuera del periodo de retención aprobado y confirma que no sean necesarias como bases de replicación. Eliminar una instantánea común reciente puede obligar a reenviar todos los datos, lo que requiere aún más espacio.
Mueve los datos fríos, amplía el pool con una topología compatible o reduce las escrituras entrantes antes de ejecutar tareas de mantenimiento intensivas. No inicies simultáneamente un scrub, una resilverización, una recepción de replicación y un borrado masivo en un pool casi lleno.
El diagnóstico del espacio de las instantáneas de ZimaSpace separa las instantáneas de las papeleras de reciclaje y los archivos activos.
El análisis de instantáneas de OpenZFS de Klara Systems relaciona el nivel de llenado del pool, el uso de instantáneas y la planificación práctica de la capacidad.
Vuelve a probar la carga de trabajo original después de la limpieza
Repite la misma carga de trabajo de escritura, instantáneas y exploración de directorios después de recuperar espacio. Compara la latencia, el rendimiento y la presión sobre el asignador en lugar de asumir que un porcentaje menor ha resuelto el problema.
Confirma que el siguiente ciclo programado de instantáneas y replicación se complete y que el pool no vuelva inmediatamente al umbral de advertencia. Configura las alertas con suficiente antelación para cubrir el crecimiento normal y el trabajo temporal más grande previsto.
Mantén el mínimo del 20 % de espacio libre cuando no haya mediciones disponibles. Auméntalo si la latencia de escritura sube, la fragmentación es alta o la divergencia de instantáneas grandes es habitual; detén las nuevas escrituras si el pool se acerca al agotamiento o empiezan a fallar las asignaciones.
Soporte y Consejos
Más para leer

¿Qué rango de temperatura es aceptable para una unidad NVMe en un mini PC?
Para muchas unidades NVMe de consumo, un objetivo útil es mantener aproximadamente entre 30 y 50 °C en reposo y por debajo de 70...

¿Cuánto espacio SSD debería reservar un servidor multimedia para ilustraciones y caché?
Comienza con el uso medido de datos de la aplicación más un margen de crecimiento del 50-100 %; las miniaturas de vista previa enriquecidas...

¿Cuántos clientes SMB simultáneos puede atender cómodamente un NAS de 1 GbE?
Un NAS de 1GbE puede atender a muchos clientes con cargas ligeras, pero solo unas pocas transferencias pesadas; el límite práctico compartido es de...

