Só pode identificar um estrangulamento no Home Assistant depois de reproduzir um sintoma estável. Um gráfico de CPU elevado, pouca RAM livre, um disco ocupado ou um contador de rede rápido não são suficientes por si só; o recurso limitante é aquele cuja pressão aumenta ao mesmo tempo que a automação, o painel, a consulta ao histórico ou a integração ficam lentos.
Comece por corrigir as condições do teste. Utilize sempre a mesma automação, dispositivo, painel, intervalo do histórico e carga de trabalho em segundo plano. Depois, observe separadamente a CPU, a memória, o armazenamento e a rede, alterando apenas uma suspeita de cada vez.
Defina o Sintoma Antes de Consultar os Gráficos de Recursos
“O Home Assistant está lento” pode significar uma ação física atrasada, um painel que demora segundos a apresentar-se, um histórico que carrega lentamente, uma integração que restabelece a ligação tarde ou um anfitrião que bloqueia durante uma cópia de segurança. Cada sintoma utiliza um caminho de dados diferente.
Escolha um evento reproduzível e registe a hora. No caso de uma luz acionada por movimento, registe a chegada do acionamento e a resposta física. Para o histórico, meça o tempo desde o início da consulta até ao primeiro resultado. Num painel, separe a resposta do servidor da renderização no navegador. Para uma integração indisponível, registe a acessibilidade da rede e os registos da integração.
Não recolha uma dúzia de gráficos sem relação entre si para procurar o pico mais alto. O teste deve indicar em que fase do sistema ocorria a espera quando surgiu o atraso visível para o utilizador.
A CPU É o Limite Quando o Trabalho Fica em Fila por Falta de Capacidade de Processamento
A CPU é uma forte candidata quando o Home Assistant ou um processo relacionado consome capacidade de processamento de forma sustentada enquanto o sintoma piora, e a mesma carga de trabalho melhora quando essa procura é removida ou isolada.
O método de utilização, saturação e erros é útil porque distingue um recurso que está simplesmente ocupado de um recurso onde o trabalho está em fila. No Home Assistant, um breve pico de CPU é menos importante do que uma saturação reproduzível que coincide com automações atrasadas ou operações na base de dados.
Verifique qual é o processo ou contentor responsável pela carga. Uma tarefa de câmara, a manutenção da base de dados, um contentor de IA local ou um serviço complementar podem saturar o anfitrião enquanto o próprio Home Assistant continua leve.
A RAM É o Limite Quando o Conjunto de Trabalho Cria Pressão
O Linux utiliza a memória que estaria inativa para a cache, pelo que pouca “memória livre” não constitui automaticamente um problema. Observe a memória disponível, a memória swap, a pressão, os limites dos cgroups e os eventos OOM.
A explicação em A cache do sistema de ficheiros do Linux pode ser recuperada é importante ao analisar um anfitrião do Home Assistant: uma máquina pode mostrar a maior parte da RAM como utilizada e ainda assim dispor de uma margem saudável.
A memória torna-se o limite provável quando a mesma carga de trabalho normal reduz repetidamente a memória disponível, provoca swap ou bloqueios durante a recuperação de memória, atinge o limite de um contentor ou gera encerramentos por OOM. Só aumente a RAM ou reduza o conjunto de trabalho ativo depois de esse padrão ser visível.
O Armazenamento É o Limite Quando a Latência Acompanha o Recorder ou as Cópias de Segurança
A pressão sobre o armazenamento pode esconder-se atrás de uma utilização baixa da CPU. As gravações do Recorder, as consultas à base de dados, as reorganizações, as cópias de segurança, as atualizações e outros contentores podem ficar em fila no mesmo dispositivo enquanto os núcleos da CPU permanecem praticamente inativos.
Um aviso de acumulação do Recorder do Home Assistant foi explicitamente associado a sistemas limitados pela CPU, limitados pela E/S ou com problemas na base de dados ou no armazenamento. Por isso, o erro deve desencadear uma correlação, não uma substituição cega da base de dados.
Observe a latência do disco, o tempo de espera de E/S, a profundidade da fila e o momento das tarefas do Recorder ou das cópias de segurança. O armazenamento é o diagnóstico mais forte quando o sintoma acompanha essas medições e desaparece quando a E/S concorrente é removida.
A Rede É o Limite Quando o Servidor Está Pronto, mas o Caminho Não
Um estrangulamento de rede pode dever-se ao débito, à perda de pacotes, a atrasos no DNS, à instabilidade do Wi-Fi, a regras da firewall ou a uma dependência de um serviço remoto. O Home Assistant pode ter a CPU inativa e um armazenamento local rápido enquanto uma integração ou um cliente aguarda pela rede.
Teste primeiro o servidor localmente e, em seguida, teste o dispositivo ou cliente afetado a partir da mesma LAN. Se os pedidos locais forem rápidos, mas uma VLAN, um segmento Wi-Fi, um nome DNS ou uma integração dependente da cloud forem lentos, mantenha a correção nesse caminho.
A utilização da rede, por si só, não é suficiente. Uma interface pouco carregada pode continuar a falhar devido à resolução, ao encaminhamento ou à perda de pacotes, enquanto uma interface ocupada pode permanecer saudável se tiver margem e poucas perdas.
Altere Uma Variável e Exija que o Sintoma se Altere
| Recurso | Evidência que reforça o diagnóstico | Teste de alteração útil |
|---|---|---|
| CPU | Saturação ou filas sustentadas durante o sintoma | Pausar o processo pesado ou isolar a carga de trabalho |
| RAM | Pressão, swap, OOM ou limite de cgroup | Reduzir os serviços ativos ou aumentar o limite testado |
| Armazenamento | A latência ou o tempo de espera de E/S acompanha o Recorder ou a cópia de segurança | Pausar a E/S concorrente ou mover o estado para um armazenamento mais rápido |
| Rede | Apenas o caminho remoto ou até ao dispositivo é lento | Utilizar uma rota local direta ou um caminho de rede alternativo |
A análise da ZimaSpace sobre a latência do armazenamento nos caminhos de controlo do Home Assistant é um bom exemplo deste método: um componente só se torna o estrangulamento quando o seu tempo coincide com o atraso real do controlo.
Pare quando uma alteração controlada melhorar de forma fiável o sintoma original. Isso constitui uma evidência mais forte do que qualquer percentagem de utilização isolada e evita que uma atualização dispendiosa resolva a camada errada.
Suporte e Dicas
Mais para Ler

Deve fazer uma cópia de segurança do Home Assistant em funcionamento ou parar primeiro o serviço?
As cópias de segurança integradas do Home Assistant podem ser executadas em tempo real; as cópias simples do sistema de ficheiros devem parar ou...

Porque é que um servidor Home Assistant fica quente ou ruidoso durante os períodos de inatividade?
Relacione os picos da ventoinha ou da temperatura do Home Assistant com o Recorder, as cópias de segurança, as integrações e as tarefas alojadas...

Quando deve reconstruir o Home Assistant em vez de o reparar?
Repare primeiro a camada do Home Assistant que falhou e que seja mais pequena, restaure de seguida um estado conhecido como bom e reconstrua...

