La sentinella per Proxmox: Atlas Watch
Il monitoraggio su Proxmox di solito diventa un progetto a sé: installare Grafana, alimentare InfluxDB, costruire a mano i dashboard. Il risultato è bello da vedere, ma la manutenzione diventa un compito in più. Atlas Watch prende una strada diversa: il monitoraggio arriva già integrato nel cockpit già in uso. I controlli girano da soli e segnalano quando qualcosa va storto: nessuno stack separato da configurare.
Perché potreste non volere uno stack di monitoraggio separato
La catena Grafana + InfluxDB + exporter è potente, ma configurarla, aggiornarla e mantenere le dashboard è un carico a sé. In un homelab la maggior parte delle persone la configura una volta e poi diventa obsoleta.
Quando il monitoraggio vive in una scheda separata, si cambia strumento tra il vedere un problema e risolverlo. L'avviso è in un posto, la soluzione in un altro.
Il peggio è un guasto silenzioso: un backup fallisce durante la notte, un pool si riempie, un servizio entra in un ciclo di riavvio. E poiché nessuno controlla, non emerge alla luce del giorno ma solo quando è troppo tardi.
Cosa fa Atlas Watch
Tiene il polso dell'host e porta a galla ciò che conta:
Controlli di salute pianificati
Un catalogo pronto di controlli viene eseguito a intervalli prestabiliti: salute dei dischi, stato dei pool, servizi, capacità e altro, senza doverlo configurare.
E-mail immediata sui riscontri critici
Quando un controllo diventa critico, arriva un'e-mail senza ritardo, con un intelligente periodo di attesa affinché le ripetizioni non la sommergano.
Centro notifiche
Ogni riscontro si raccoglie in un unico posto; ogni avviso mostra dove si trova su una vera mini-topologia, non una riga astratta.
Riepilogo giornaliero
Gli elementi non critici si accumulano in un riepilogo: nessuna e-mail per ogni piccola cosa, il quadro della giornata in un colpo d'occhio.
Consegna flessibile
L'e-mail può essere inviata localmente in modo diretto, oppure passare attraverso il proprio server SMTP; viene scelto il percorso migliore per la configurazione in uso.
Regole personalizzate
Oltre al catalogo pronto si definiscono soglie e regole proprie; Watch sorveglia ciò che gli è stato detto di sorvegliare.
Domande frequenti
- Devo installare Grafana o InfluxDB per Atlas Watch?
- No. Watch è integrato in Atlas; non è necessario configurare uno stack di monitoraggio separato. Controlli e avvisi funzionano fin da subito.
- Come mi arrivano gli avvisi?
- I riscontri critici arrivano immediatamente via e-mail; quelli non critici si accumulano in un riepilogo giornaliero. L'e-mail può essere inviata localmente o passare attraverso il proprio server SMTP. Le notifiche si raccolgono anche nel centro notifiche del pannello.
- Funziona senza internet?
- Sì. Watch viene eseguito localmente sull'host; finché può inviare e-mail localmente o tramite il proprio SMTP, non ha bisogno di internet.
- Lo stesso avviso la bombarderà tutto il giorno?
- No. Gli avvisi critici hanno un intelligente periodo di attesa; lo stesso riscontro non produce la stessa e-mail più e più volte. Le ripetizioni si vedono comunque, ma la casella di posta non si riempie.
- Posso scegliere cosa sorveglia?
- Sì. Accanto al catalogo di controlli pronto si definiscono soglie e regole proprie; si decide quale riscontro è critico e quale va nel riepilogo.
- Watch sostituisce uno strumento di monitoraggio come Pulse?
- Compiti diversi. Gli strumenti di monitoraggio si specializzano nelle dashboard; Watch è la sentinella della cabina di comando che gestisce, sta accanto agli aggiornamenti, all'archiviazione e all'accesso nello stesso prodotto. Se il monitoraggio è il compito principale, ha senso uno strumento dedicato; per gestire l'host da un unico posto, Watch è già lì.
Voci collegate
- Il lavoro di backup si è fermato in silenzio: il guasto più caro non è quello rumoroso Un backup che fallisce rumorosamente viene riparato lo stesso giorno. Un backup che si ferma in silenzio si scopre il giorno in cui serviva. La differenza non sta in una notifica, sta in ciò che guardi.
- Cosa dovrebbe dirvi la prima schermata di un server Proxmox? La maggior parte delle panoramiche risponde a "cosa c'è". La domanda utile è "c'è qualcosa che non va, e serve la mia attenzione oggi". Sono due schermate diverse, e solo una vale la pena aprire ogni mattina.
- Vi serve uno stack di metriche, o la vista integrata risponde già alla vostra domanda? Avvisi e metriche sono strumenti diversi per domande diverse. La vista integrata risponde benissimo a "è rotto adesso". Uno stack di metriche risponde a "cosa succedeva martedì scorso alle tre", ed è l'unica ragione per farne girare uno.
- Stanotte è successo qualcosa: dove sta davvero la registrazione Un avviso dice che è successo qualcosa. Un log dice perché. Il punto: la registrazione che serve di più copre il minuto in cui la macchina è morta, e in un'installazione predefinita è proprio quella che più facilmente manca.