Soluzione della community

Ricevi sul telefono gli avvisi di guasto RAID di ZimaOS

A RAID5 user wanted immediate phone, email or Discord alerts when a ZimaOS drive fails instead of relying on the dashboard status.

In sintesi: non affidarti solo al dashboard di ZimaOS per rilevare i guasti RAID

Un RAID può rimanere online in modalità degradata dopo il guasto di un membro: è proprio in questo momento che è più probabile che l’utente non si accorga del problema se lo nota solo durante un accesso successivo. La configurazione pratica consiste nel mantenere ZimaOS Storage come fonte di configurazione e aggiungere poi un monitor indipendente dello stato SMART e dei dischi, in grado di inviare avvisi al telefono, su Discord, via email o tramite webhook.

La procedura del 2026 utilizzava Scrutiny insieme a ntfy. Rimane una soluzione sensata, perché Scrutiny può esaminare i dati SMART delle unità fisiche e supporta diversi canali di notifica.

Installa un monitor dello stato dei dischi che possa vedere le unità fisiche

Scrutiny deve poter accedere ai dispositivi SATA/NVMe effettivi, non solo a un filesystem montato. In Docker, verifica che l’app disponga dei dispositivi /dev/sdX o /dev/nvmeX necessari e che la raccolta dei dati SMART abbia esito positivo. Se i dischi si trovano dietro un HBA, un bridge USB o un controller RAID, il collector potrebbe richiedere una gestione specifica del controller.

smartctl -H /dev/sda
smartctl -a /dev/sda
nvme smart-log /dev/nvme0

La pagina notifiche di Scrutiny elenca email, webhook, Discord, Gotify, ntfy, Slack, Telegram e altre destinazioni. Il monitoraggio Netdata copre le metriche dell’host che SMART non rileva.

Testa ntfy prima di collegarlo agli eventi SMART

Per prima cosa, verifica che il telefono riceva un semplice messaggio di prova:

curl -d "Zima drive alert test" https://ntfy.sh/YOUR_UNIQUE_TOPIC
Notifica Android di ntfy che mostra un messaggio di prova relativo a un avviso del disco Zima
La procedura della community ha verificato che un topic ntfy attivato da ZimaOS potesse inviare immediatamente una notifica al telefono prima di collegarlo al monitoraggio dello stato dei dischi.
App Android ntfy che mostra il topic zima-alerts sottoscritto con due notifiche
Il topic ntfy sottoscritto offre una destinazione semplice per le notifiche SMART e dei guasti dei dischi generate al di fuori del dashboard di ZimaOS.

Usa un nome del topic difficile da indovinare oppure un’istanza ntfy self-hosted con autenticazione se il contenuto degli avvisi è sensibile. I topic ntfy pubblici non devono essere considerati segreti solo perché hai scelto un nome facile da ricordare.

Collega Scrutiny alla destinazione degli avvisi

Le versioni attuali di Scrutiny supportano gli URL di notifica tramite scrutiny.yaml. Mantieni la configurazione delle notifiche nei dati persistenti dell’app, così la ricreazione del container non rimuoverà silenziosamente gli avvisi. Dopo averla modificata, riavvia Scrutiny ed esegui il controllo dello stato delle notifiche:

curl -X POST http://SCRUTINY_IP:PORT/api/health/notify

Una notifica di prova ricevuta correttamente è importante, perché un dashboard SMART verde non dimostra che il canale di notifica in uscita funzioni.

Monitora lo stato del RAID separatamente dallo stato SMART

SMART può segnalare un problema a un disco fisico, ma il degrado RAID è uno stato dell’array. Un disco può scomparire improvvisamente senza fornire un utile avviso SMART preventivo. Controlla entrambi:

cat /proc/mdstat
mdadm --detail /dev/md0

Lo stato RAID di mdadm di Linux è il riferimento a livello di array. La procedura di ripristino RAID descrive il perimetro del ripristino dal lato ZimaOS.

Definisci avvisi che indichino cosa fare

Non inviare lo stesso messaggio vago di “problema al disco” per ogni situazione. Gli avvisi utili distinguono almeno: avviso SMART critico, disco mancante, RAID degradato, RAID in ricostruzione, filesystem quasi pieno e temperatura dello storage superiore alla soglia scelta. Quando possibile, includi modello e numero di serie del dispositivo e il nome dell’array, così saprai quale disco controllare prima di aprire il case.

Non aspettare che SMART diventi la tua strategia di backup

Un disco può guastarsi senza un lungo preavviso SMART e il RAID non protegge da eliminazioni, ransomware o perdita del case. Conserva una seconda copia verificata dei dati insostituibili. Il backup di ZimaOS copre il livello di ripristino che il monitoraggio non può sostituire.

Usa un secondo monitor dell’uptime per lo stack di monitoraggio stesso

Se Scrutiny o ntfy smette di funzionare, l’assenza di avvisi può sembrare un segnale che “tutto è in salute”. Monitora l’endpoint web di Scrutiny o il servizio di notifica con un semplice controllo dell’uptime. Il monitoraggio Uptime Kuma è utile per questo livello di meta-monitoraggio.

Domande frequenti

ZimaOS mi invia un’email quando si guasta un disco RAID?

Non dare per scontato che la visibilità nel dashboard equivalga all’invio di avvisi. Aggiungi un canale di notifica indipendente e testalo dall’inizio alla fine.

Scrutiny può rilevare il degrado RAID?

Scrutiny valuta principalmente i dati SMART dei dischi fisici. Controlla separatamente lo stato dell’array RAID degradato tramite mdadm/ZimaOS.

Cosa succede se SMART indica che un disco guasto è in buone condizioni?

Un disco può scomparire a causa di problemi di alimentazione, cablaggio, controller o di un guasto elettronico improvviso senza un avviso SMART predittivo. Monitora anche la presenza dei dispositivi e lo stato del RAID.

ntfy è sicuro per gli avvisi relativi ai dischi?

Sì, se configurato correttamente. Usa un topic univoco o autenticato, soprattutto se le notifiche includono nomi host, numeri di serie o altri dettagli dell’infrastruttura.

Con quale frequenza dovrebbe essere controllato SMART?

Un controllo giornaliero è comune per la raccolta completa dei dati, mentre la presenza dei dispositivi e dell’array critici può essere verificata più frequentemente. Evita test eccessivi che aggiungono attività inutili sui dischi.