상태 점검은 계층별로 구성하세요. 먼저 Home Assistant 애플리케이션의 응답을 확인한 다음, 각 종속성이 실제로 중요한 경우에만 데이터베이스, MQTT, DNS, 스토리지 및 원격 경로를 테스트하세요.
실행 중으로 표시된 컨테이너도 아직 시작 중이거나, 스토리지 문제로 차단되었거나, 브로커 연결이 끊겼거나, 기록을 저장하지 못하는 상태일 수 있습니다. 비용이 적은 로컬 준비 상태 점검부터 시작하고, 이름이 명확한 별도 종속성 점검을 추가하며, 충분한 시작 유예 시간을 허용한 뒤 복구 자동화를 활성화하기 전에 알림을 보내세요. 모든 프로브는 무엇이 실패했는지와 통과 결과가 무엇을 입증하는지 명확히 알려야 합니다.
프로브를 작성하기 전에 정상 상태를 정의하세요
가정에서 작동해야 하는 기능을 나열하세요. 로컬 UI가 응답하고, 자동화가 실행되며, Recorder가 기록을 저장하고, MQTT 장치가 상태를 주고받고, DNS가 필요한 이름을 확인하며, 마운트된 스토리지가 쓰기 가능한 상태여야 합니다. 단일 녹색 상태만으로는 이러한 모든 기능을 입증할 수 없습니다.
실용적인 Docker 상태 점검 가이드는 단순한 프로세스 존재 여부와 애플리케이션 상태를 구분하고, 프로브가 컨테이너 내부에서 실행되어 성공 또는 실패를 보고한다고 설명합니다. Home Assistant 점검에서 무엇을 관찰해야 하는지 정의할 때 이 애플리케이션 수준의 구분을 활용하세요.
모든 프로브에 담당 대상 하나와 실패 의미 하나를 지정하세요. Core 점검이 데이터베이스까지 검증하는 것처럼 가장해서는 안 되며, MQTT 소켓 점검이 장치 메시지가 최신 상태라고 주장해서도 안 됩니다. 결과가 구체적인 다음 조치로 이어지지 않는다면 해당 프로브를 단순화하거나 제거하세요.
가벼운 Home Assistant 준비 상태 점검을 추가하세요
빠르게 완료되며 Python 프로세스가 존재한다는 사실이 아니라 애플리케이션이 응답하고 있음을 입증하는 로컬 엔드포인트나 명령을 사용하세요. 타임아웃은 간격보다 짧게 설정하고, 적절한 재시도 횟수와 측정된 콜드 스타트 시간에 충분한 시작 유예 시간을 지정하세요.
일반적으로 Compose 상태 점검은 간격, 타임아웃, 재시도 및 시작 기간을 제어하는 설정을 제공하며, 종속성 조건을 사용하면 필수 구성 요소가 정상 상태가 될 때까지 소비자 서비스의 시작을 지연할 수 있습니다. 핵심 운영 방식은 공격적인 폴링 일정이 아니라 실행 상태가 아닌 준비 상태입니다.
콜드 스토리지에서 Home Assistant를 시작하고 프로브가 처음 성공하는 시점을 기록하세요. 정상적인 시작 과정에서 매번 실패한다면 테스트를 약화시키지 말고 유예 시간을 늘리세요. UI나 필수 서비스가 사용 가능해지기 전에 성공한다면 점검이 너무 피상적인 것이므로 더 대표적인 응답을 확인하도록 수정해야 합니다.
종속성을 별도로 점검하고 실패 의미를 보존하세요
데이터베이스 연결, MQTT 브로커, DNS 확인 및 필수 스토리지 마운트에 대해 독립적인 점검을 만드세요. 읽기 전용 쿼리나 전용 테스트 경로에 대한 작고 되돌릴 수 있는 쓰기 작업을 우선 사용하세요. 가용성을 입증한다는 이유로 Home Assistant 테이블을 수정하거나 실제 장치에 명령을 게시하지 마세요.
검색 및 로컬 제어 종속성과 원격 액세스 종속성을 구분하세요. Home Assistant 구성 요소 종속성에 대한 ZimaSpace 개요는 어떤 장애가 즉시 알림을 발생시켜야 하고 어떤 장애를 성능 저하 경고로 남겨도 되는지 결정하는 데 유용한 지도를 제공합니다.
실패한 계층을 결과에 표시하세요. Home Assistant는 정상인데 데이터베이스 점검이 실패한다면 Core를 재시작하지 말고 스토리지나 인증 정보를 조사하세요. 원격 액세스만 실패한다면 로컬 제어는 계속 실행하세요. 이렇게 분리하면 하나의 빨간색 종속성 때문에 정상 서비스의 증거가 사라지는 것을 막을 수 있습니다.
실패, 복구 및 알림 시점을 테스트하세요
점검 시간 동안 중요하지 않은 종속성을 한 번에 하나씩 중지하거나 테스트 경로를 일시적으로 차단하세요. 해당 프로브가 실패하고, 관련 없는 점검은 녹색 상태를 유지하며, 알림에 올바른 계층이 표시되는지 확인하세요. 종속성을 복구한 뒤 수동으로 상태를 편집하지 않아도 동일한 점검이 정상으로 전환되는지 검증하세요.
여러 번의 실제 장애를 관찰한 후에만 자동 재시작을 추가하세요. 쿨다운과 최대 시도 횟수를 사용하고, 로그를 보존하지 않은 채 데이터베이스와 Home Assistant를 동시에 재시작하지 마세요. 재시작은 검증을 위한 관문일 뿐이며, 근본적인 종속성이 복구되었다는 증거는 아닙니다.
정상적인 설계는 예상 시간 내에 통제된 장애를 감지하고, 해당 장애에 의존하지 않는 로컬 기능을 유지하며, 복구 후 상태를 정상으로 되돌립니다. 상당한 부하나 오탐을 발생시키는 프로브는 롤백하세요. 모든 종속성 점검이 통과하는데도 서비스가 계속 준비되지 않는다면 애플리케이션 수준 테스트에 더 심층적인 증거가 필요하므로 문제를 상위 단계로 escalte하세요.
지원 및 팁
더 읽어보기

Home Assistant가 Wi-Fi에서는 작동하지만 이더넷이나 VPN에서는 작동하지 않음
각 네트워크 경로를 개별적으로 테스트하고, 인터페이스와 라우팅 상태를 확인한 다음, 직접 IP 연결과 검색 기능을 구분하여 실패한 계층만 복구하세요.

보호되지 않은 데이터를 남기지 않고 Home Assistant를 폐기하는 방법
교체 또는 보관을 입증하고, 모든 신뢰 경로를 폐기하며, 데이터를 저장하는 각 장치를 안전하게 삭제하고, 문서화된 보호 복구 사본만 보존하세요.

홈 서버에서 Home Assistant 자동 업데이트를 사용해야 할까요?
가정에 미치는 영향, 호환성 위험, 관찰 시간, 복구 준비 상태를 고려해 수동 업데이트, 알림만 제공, 또는 단계적 자동 업데이트를 선택하세요.

