Reserva suficiente margen de CPU para la carga de trabajo repetible más exigente a fin de cumplir los objetivos de tiempo entre evento y acción y de reinicio; no existe un porcentaje universal defendible para todas las configuraciones de Home Assistant.
Un host de cuatro núcleos puede mostrar un promedio moderado mientras un núcleo está saturado, o parecer limitado por la CPU cuando el verdadero límite es la espera de almacenamiento, la presión de memoria o la limitación térmica. Define la combinación simultánea realista más exigente, mide la latencia de control y el comportamiento de cada núcleo, y conserva el margen de recursos más pequeño que supere repetidamente las pruebas sin detener los servicios complementarios normales.
Define el pico y el límite percibido por el usuario
Construye una carga de trabajo que combine el pico normal de automatizaciones más exigente con el uso del panel y tareas en segundo plano planificadas, como copias de seguridad, mantenimiento de la base de datos, voz o procesamiento seleccionado de cámaras. Define la latencia aceptable entre evento y acción, la respuesta del panel y la disponibilidad tras un reinicio antes de medir la utilización.
No uses una prueba de estrés artificial de todos los núcleos como único pico. Mide la capacidad del hardware, pero no la combinación de planificación, base de datos, integraciones y complementos que los usuarios experimentan realmente.
Una línea base válida ejecuta tres veces el mismo número de dispositivos, las mismas integraciones, el mismo estado de la base de datos y los mismos servicios vecinos. Si la carga de trabajo no puede repetirse, ningún margen derivado de ella es fiable.
Captura una ejecución durante un periodo de poca actividad como control. La diferencia entre los estados de poca actividad y de pico revela la sensibilidad de la carga de trabajo; el porcentaje máximo por sí solo no puede mostrar si el sistema comenzó cerca de la saturación.
Lee por separado la saturación de cada núcleo y la espera
Registra la utilización de cada núcleo, la carga, el tiempo de apropiación en máquinas virtuales, la espera de E/S, la frecuencia, la temperatura y el proceso de Home Assistant junto con la latencia percibida por el usuario. Alinea todas las mediciones con las mismas marcas de tiempo.
Como un núcleo saturado puede ocultarse dentro de un promedio de todo el sistema mucho más bajo, analiza el comportamiento del proceso en lugar de asumir que la utilización total representa el margen disponible.
Si un núcleo llega al máximo mientras aumenta la latencia, es probable que estén implicadas la capacidad de procesamiento en un solo hilo o las tareas bloqueantes. Si la espera de E/S aumenta primero, corrige el comportamiento del almacenamiento o de la base de datos. Si la frecuencia disminuye con la temperatura, corrige la refrigeración antes de reservar más capacidad nominal.
Crea margen con la planificación y el aislamiento
Mueve las tareas opcionales fuera del periodo de control más exigente, limita los contenedores complementarios que generan mucha actividad y evita que las tareas de cámara, IA o multimedia consuman todos los núcleos ejecutables. Asegúrate de que Home Assistant y los agentes esenciales puedan seguir avanzando durante esos picos.
Compara el margen de procesador determinado por la carga de trabajo solo después de medir el limitador del sistema actual. Comprar un equipo más rápido no corrige las tareas sin límites ni la espera de almacenamiento.
Repite las pruebas después de cada cambio de planificación o límite. Si la latencia cumple los objetivos sin cambiar el hardware, el margen recuperado es margen operativo; si el mismo núcleo sigue saturado, compara una CPU más potente únicamente con la misma carga de trabajo.
Establece la reserva a partir de ejecuciones repetidas satisfactorias
Usa el pico máximo observado en ejecuciones limpias y repetidas, y conserva capacidad adicional para el crecimiento previsto de las integraciones y una tarea de mantenimiento simultánea. Expresa el resultado como un umbral de servicio probado, no como un objetivo universal de inactividad.
El procedimiento de la evaluación comparativa del margen de recursos proporciona la línea base multidimensional para CPU, memoria, almacenamiento y red.
La prueba se supera cuando el pico original cumple los objetivos de latencia y reinicio en ejecuciones consecutivas sin limitación térmica ni paradas forzadas de servicios. Escala o actualiza el sistema cuando la misma saturación específica de la CPU persiste después de descartar las causas relacionadas con la planificación, las integraciones y la E/S.
Soporte y Consejos
Más para leer

Cómo optimizar las conexiones de la base de datos de Immich para contenedores simultáneos
No aumentes primero max_connections. Mide las sesiones de Immich, suma la demanda total de todos los contenedores, conserva margen para la administración y ajusta...

Cómo evitar trabajos o importaciones duplicados en Immich
Separa los trabajos repetidos de los recursos duplicados. Usa una única ruta de ingesta canónica, controla los reintentos y los cambios de ruta, y...

Cómo reparar Immich después de que su volumen de base de datos se llene
Nunca elimines el WAL de PostgreSQL para liberar espacio. Detén las escrituras de Immich, conserva el estado de la base de datos, añade capacidad...

