Vagten for Proxmox: Atlas Watch
Overvågning på Proxmox bliver som regel til sit eget projekt: installere Grafana, fodre InfluxDB, bygge dashboardene i hånden. Resultatet ser godt ud, men vedligeholdelsen bliver også en opgave. Atlas Watch går en anden vej: overvågning er indbygget i det cockpit, der allerede administreres. Tjekkene kører af sig selv, og der gives besked, når noget går galt. Ingen separat stack at sætte op.
Hvorfor en separat overvågningsstack sjældent er svaret
Kæden Grafana + InfluxDB + exporter er kraftfuld, men at sætte den op, opdatere den og vedligeholde dashboardene er en byrde i sig selv. I et homelab sætter de fleste det op én gang, hvorefter det forældes.
Når overvågning bor i en separat fane, skiftes der værktøj mellem at se et problem og at løse det. Alarmen er ét sted, løsningen et andet.
Det værste er en stille fejl: en sikkerhedskopi fejler om natten, en pool fyldes op, en tjeneste havner i en genstartsløkke. Og fordi ingen holder øje, kommer det ikke frem i dagslys, men først når det er for sent.
Hvad Atlas Watch gør
Den holder en finger på hostens puls og bringer det, der betyder noget, frem:
Planlagte sundhedstjek
Et færdigt katalog med tjek kører med faste intervaller: diskens sundhed, pool-status, tjenester, kapacitet og mere, uden nogen opsætning.
Øjeblikkelig e-mail ved kritiske fund
Når et tjek bliver kritisk, ankommer en e-mail uden forsinkelse, med en smart nedkølingsperiode, så gentagelser ikke overvælder indbakken.
Notifikationscenter
Hvert fund samles ét sted; hver alarm viser, hvor det befinder sig på en rigtig mini-topologi, ikke som en abstrakt linje.
Daglig oversigt
Ikke-kritiske elementer samles i en oversigt: ingen e-mail for hver lille ting, dagens billede i ét overblik.
Fleksibel levering
E-mail kan sendes lokalt direkte eller gå ud via egen SMTP-server; den bedste vej vælges til opsætningen.
Egne regler
Ud over det færdige katalog defineres egne tærskler og regler; Watch holder øje med det, den bliver bedt om.
Ofte stillede spørgsmål
- Skal jeg installere Grafana eller InfluxDB til Atlas Watch?
- Nej. Watch er indbygget i Atlas; en separat overvågningsstack er ikke nødvendig. Tjek og alarmer virker lige ud af boksen.
- Hvordan når alarmerne mig?
- Kritiske fund ankommer straks via e-mail; ikke-kritiske samles i en daglig oversigt. E-mail kan sendes lokalt eller gå ud via egen SMTP-server. Notifikationer samles også i notifikationscenteret i panelet.
- Virker det uden internet?
- Ja. Watch kører lokalt på hosten; så længe den kan sende e-mail lokalt eller via egen SMTP-server, har den ikke brug for internet.
- Vil den samme alarm bombardere mig hele dagen?
- Nej. Kritiske alarmer har en smart nedkølingsperiode; det samme fund giver ikke den samme e-mail igen og igen. Gentagelser vises stadig, men indbakken fyldes ikke op.
- Kan jeg vælge, hvad den holder øje med?
- Ja. Ud over det færdige tjekkatalog defineres egne tærskler og regler; det afgøres, hvilket fund der er kritisk, og hvilket der bliver et oversigtselement.
- Erstatter Watch et overvågningsværktøj som Pulse?
- Forskellige opgaver. Overvågningsværktøjer specialiserer sig i dashboards; Watch er vagten for det cockpit, der administreres, og den sidder side om side med opdateringer, lagring og adgang i samme produkt. Er overvågning hovedopgaven, giver et dedikeret værktøj mening; skal hosten administreres fra ét sted, er Watch allerede der.
Relaterede artikler
- Kopieringsjobbet stoppede stille: den dyreste fejl er ikke den højlydte En kopiering, der fejler højlydt, bliver repareret samme dag. En kopiering, der stopper stille, opdages den dag, den blev brugt. Forskellen ligger ikke i en notifikation, den ligger i, hvad du kigger på.
- Hvad bør den første skærm på en Proxmox-server fortælle dig? De fleste oversigtsskærme svarer på "hvad der findes". Det nyttige spørgsmål er "er noget galt, og har det brug for mig i dag". Det er to forskellige skærme, og kun én er værd at åbne hver morgen.
- Har du brug for en metrikstak, eller svarer den indbyggede visning allerede på dit spørgsmål? Advarsler og metrikker er forskellige værktøjer til forskellige spørgsmål. Den indbyggede visning svarer fint på "er noget i stykker nu". En metrikstak svarer på "hvad skete der sidste tirsdag klokken tre", og det er den eneste grund til at drive en.
- Der skete noget i nat: hvor optegnelsen faktisk ligger En advarsel siger, at der skete noget. En log siger hvorfor. Hagen er, at den optegnelse du har mest brug for dækker minuttet, hvor maskinen døde, og ved en standardinstallation er det netop den, der oftest mangler.