Configura i controlli di integrità a più livelli: verifica prima la risposta dell’applicazione Home Assistant, quindi testa il database, MQTT, DNS, lo spazio di archiviazione e il percorso remoto solo dove ciascuna dipendenza è effettivamente necessaria.
Un container contrassegnato come in esecuzione potrebbe essere ancora in fase di avvio, bloccato sullo spazio di archiviazione, disconnesso dal broker o incapace di scrivere la cronologia. Inizia con un controllo locale economico della disponibilità, aggiungi controlli separati delle dipendenze con nomi chiari, concedi un periodo di tolleranza sufficiente per l’avvio e invia avvisi prima di abilitare l’automazione del ripristino. Ogni verifica dovrebbe indicare cosa non ha funzionato e cosa dimostra un risultato positivo.
Definisci il comportamento corretto prima di scrivere una verifica
Elenca le funzioni che devono funzionare per la tua famiglia: l’interfaccia locale risponde, le automazioni vengono eseguite, Recorder può scrivere, i dispositivi MQTT scambiano lo stato, il DNS risolve i nomi richiesti e lo spazio di archiviazione montato è scrivibile. Un singolo stato positivo non può dimostrare tutte queste funzioni.
Una guida pratica ai controlli di integrità Docker distingue lo stato dell’applicazione dalla semplice esistenza del processo e spiega che una verifica viene eseguita all’interno del container e comunica un esito positivo o negativo. Usa questa distinzione a livello applicativo quando definisci cosa deve osservare il controllo di Home Assistant.
Assegna un responsabile e un significato specifico di errore a ogni verifica. Il controllo di Core non deve fingere di convalidare il database e un controllo del socket MQTT non deve affermare che i messaggi dei dispositivi siano aggiornati. Se un risultato non può portare a un’azione successiva specifica, semplifica o rimuovi quella verifica.
Aggiungi un controllo leggero della disponibilità di Home Assistant
Usa un endpoint o un comando locale che si completi rapidamente e dimostri che l’applicazione risponde, non soltanto che il processo Python esiste. Imposta un timeout più breve dell’intervallo, un numero ragionevole di tentativi e un periodo di tolleranza all’avvio abbastanza lungo da coprire il tempo di avvio a freddo misurato.
I controlli di integrità di Compose espongono normalmente i parametri di intervallo, timeout, tentativi e periodo iniziale, mentre le condizioni delle dipendenze possono ritardare l’avvio di un consumer finché un prerequisito non raggiunge uno stato corretto. Il comportamento operativo fondamentale è la disponibilità, non lo stato di esecuzione, non una pianificazione di polling aggressiva.
Avvia Home Assistant da uno spazio di archiviazione freddo e registra quando la verifica riesce per la prima volta. Se fallisce durante ogni avvio normale, aumenta il periodo di tolleranza invece di indebolire il test. Se riesce prima che l’interfaccia o il servizio richiesto siano utilizzabili, il controllo è troppo superficiale e richiede una risposta più rappresentativa.
Controlla separatamente le dipendenze e conserva il significato degli errori
Crea controlli indipendenti per la connessione al database, il broker MQTT, la risoluzione DNS e il montaggio dello spazio di archiviazione richiesto. Preferisci una query in sola lettura o una piccola scrittura reversibile in un percorso di test dedicato; non modificare mai le tabelle di Home Assistant né pubblicare comandi a dispositivi reali solo per dimostrare la disponibilità.
Mantieni distinte le dipendenze per il rilevamento e il controllo locale da quelle per l’accesso remoto. La panoramica di ZimaSpace sulle dipendenze dei componenti di Home Assistant fornisce una mappa utile per decidere quale errore debba generare immediatamente un avviso urgente e quale possa rimanere un avviso di degrado.
Indica nel risultato il livello che ha generato l’errore. Se Home Assistant è integro ma il controllo del database fallisce, analizza lo spazio di archiviazione o le credenziali invece di riavviare Core. Se fallisce solo l’accesso remoto, mantieni attivo il controllo locale. Questa separazione impedisce che una dipendenza in errore cancelli le prove del corretto funzionamento degli altri servizi.
Verifica errori, ripristino e tempistiche degli avvisi
Durante una finestra di manutenzione, arresta una dipendenza non critica alla volta oppure blocca temporaneamente il relativo percorso di test. Conferma che la verifica corrispondente fallisca, che i controlli non correlati rimangano positivi e che l’avviso indichi il livello corretto. Ripristina la dipendenza e verifica che lo stesso controllo torni positivo senza modificare manualmente lo stato.
Aggiungi i riavvii automatici solo dopo aver osservato diversi errori reali. Usa periodi di raffreddamento e un numero massimo di tentativi, e non riavviare mai contemporaneamente il database e Home Assistant senza conservare i log. Un riavvio è una fase di verifica, non la prova che la dipendenza sottostante sia stata ripristinata.
Una progettazione corretta rileva l’errore controllato entro la finestra prevista, conserva le funzioni locali che non dipendono da esso e torna allo stato positivo dopo il ripristino. Annulla le verifiche che generano un carico significativo o falsi allarmi; aumenta il livello di intervento se il servizio rimane non disponibile mentre tutti i controlli delle dipendenze risultano positivi, perché in tal caso il test a livello applicativo richiede prove più approfondite.
Supporto e consigli
Altro da leggere

Home Assistant funziona tramite Wi-Fi, ma non tramite Ethernet o VPN
Testa separatamente ogni percorso di rete, verifica lo stato dell’interfaccia e del routing, distingui tra IP diretto e rilevamento, quindi ripara solo il livello...

Come dismettere Home Assistant senza lasciare dati non protetti
Dimostra la sostituzione o l’archiviazione, revoca ogni percorso di attendibilità, sanifica ogni dispositivo contenente dati e conserva solo copie di ripristino protette e documentate.

Dovresti usare gli aggiornamenti automatici di Home Assistant su un server domestico?
Scegli gli aggiornamenti manuali, con sole notifiche o automatici graduali in base all’impatto domestico, al rischio di compatibilità, al tempo di osservazione e alla...

