¿Cuánto espacio libre debe conservar ZFS antes de que se degrade el rendimiento de las instantáneas?

Eva Wong es la Redactora técnica y manitas residente en ZimaSpace. Una geek de toda la vida con pasión por los homelabs y el software de código abierto, se especializa en traducir conceptos técnicos complejos en guías accesibles y prácticas. Eva cree que el autoalojamiento debe ser divertido, no intimidante. A través de sus tutoriales, empodera a la comunidad para desmitificar las configuraciones de hardware, desde construir su primer NAS hasta dominar los contenedores Docker.

Mantén aproximadamente un 20 % del pool ZFS libre como punto de partida práctico. La conocida regla del 80 % de uso es una medida preventiva, no un precipicio: la carga de trabajo, la disposición de los vdev, el tamaño de registro, la fragmentación y los bloques retenidos por las instantáneas determinan cuándo se degrada realmente el rendimiento.

Las instantáneas importan porque los bloques sobrescritos o eliminados no pueden volver al espacio libre mientras una instantánea siga haciendo referencia a ellos. Por lo tanto, un pool puede parecer estable hasta que una reescritura grande, una recepción de replicación o una depuración revelan lo poco que queda de espacio de trabajo. Esta distinción determina el método de medición, el margen de seguridad y la condición de parada. Esta distinción determina el método de medición, el margen de seguridad y la condición de parada.

Considera el 80 % de utilización como un umbral para actuar pronto

Con una utilización baja, ZFS tiene más opciones para asignar bloques nuevos. A medida que el pool se llena, resulta más difícil encontrar regiones libres y las actualizaciones de copia al escribir pueden requerir más trabajo del asignador, especialmente en pools de HDD fragmentados.

Empieza a tomar medidas cerca del 80 % de uso en lugar de esperar a que se produzca un evento de falta de espacio. El almacenamiento de máquinas virtuales con muchas escrituras, las bases de datos y las operaciones de E/S aleatorias pequeñas necesitan más margen que un archivo con operaciones mayormente secuenciales.

Mide tanto a nivel del pool como del dataset. Las cuotas y las reservas pueden hacer que un dataset falle aunque el pool informe de espacio libre, mientras que las instantáneas pueden ocupar espacio que las herramientas de directorio habituales no muestran.

Observa las señales que revelan una presión real

Controla la capacidad del pool, la fragmentación, la latencia de escritura, la tendencia del espacio libre, el espacio usado por las instantáneas y el tamaño de los trabajos de replicación o copia de seguridad pendientes. Un solo porcentaje no puede describir todas estas limitaciones.

Compara la latencia durante la carga de trabajo normal al 70 %, 80 % y niveles de utilización superiores, si puedes hacerlo de forma segura. La advertencia significativa es un aumento repetible de la latencia o una disminución del rendimiento con la misma carga.

Usa la siguiente tabla de decisiones para convertir la utilización y el comportamiento en acciones.

Estado observado Veredicto Siguiente acción
Menos del 70 % de uso; latencia estable Buen margen disponible Continúa supervisando la tendencia
Alrededor del 80 % de uso o aumento de la latencia Umbral de actuación Depura de forma segura, mueve datos o amplía
Más del 90 % de uso; asignaciones fallidas Crítico Detén las escrituras no esenciales y recupera espacio

Recupera margen sin crear un segundo incidente

Elimina únicamente las instantáneas que estén fuera del periodo de retención aprobado y confirma que no sean necesarias como bases de replicación. Eliminar una instantánea común reciente puede obligar a reenviar todos los datos, lo que requiere aún más espacio.

Mueve los datos fríos, amplía el pool con una topología compatible o reduce las escrituras entrantes antes de ejecutar tareas de mantenimiento intensivas. No inicies simultáneamente un scrub, una resilverización, una recepción de replicación y un borrado masivo en un pool casi lleno.

El diagnóstico del espacio de las instantáneas de ZimaSpace separa las instantáneas de las papeleras de reciclaje y los archivos activos.

El análisis de instantáneas de OpenZFS de Klara Systems relaciona el nivel de llenado del pool, el uso de instantáneas y la planificación práctica de la capacidad.

-15% OFF

Vuelve a probar la carga de trabajo original después de la limpieza

Repite la misma carga de trabajo de escritura, instantáneas y exploración de directorios después de recuperar espacio. Compara la latencia, el rendimiento y la presión sobre el asignador en lugar de asumir que un porcentaje menor ha resuelto el problema.

Confirma que el siguiente ciclo programado de instantáneas y replicación se complete y que el pool no vuelva inmediatamente al umbral de advertencia. Configura las alertas con suficiente antelación para cubrir el crecimiento normal y el trabajo temporal más grande previsto.

Mantén el mínimo del 20 % de espacio libre cuando no haya mediciones disponibles. Auméntalo si la latencia de escritura sube, la fragmentación es alta o la divergencia de instantáneas grandes es habitual; detén las nuevas escrituras si el pool se acerca al agotamiento o empiezan a fallar las asignaciones.

Soporte y Consejos

Más para leer

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.