Sıcaklık: hiçbir şeyi bozmayan ama her şeyi kısaltan arıza
Fazla ısınan bir sunucu çökmez. Yavaşlar ve daha hızlı yaşlanır. Hata vermediği için de yıllarca fark edilmez.
AtlasPVE ·
Bu madde şunları karşılıyor
- proxmox disk sıcaklığı
- proxmox sunucu ısınıyor
- proxmox cpu sıcaklık takibi
- sunucu dolapta çalışır mı
- proxmox fan gürültüsü
Fazla ısınan bir sunucu çökmüyor. Yavaşlıyor ve daha hızlı yaşlanıyor. Hiçbir yerde hata vermediği için de aylarca, bazen yıllarca fark edilmiyor.
Üç etki, sessizlik sırasına göre
Yavaşlama. İşlemciler kendilerini korumak için hızlarını düşürür. Hiçbir şey hata vermez; makine yalnızca yavaştır. Üstelik tam da yoğun çalışırken yavaştır, yani en az fark edileceği anda: "yük var, tabii ki yavaş" denir ve geçilir.
Yaşlanma. Sürekli sıcaklık altında her parçanın beklenen ömrü düşer. Bunu bugün görmezsiniz. İki yıl sonra, olması gerekenden erken gelen bir arıza olarak görürsünüz.
Birlikte arızalanma. Asıl önemli olan bu ve kimse söylemiyor. Sıcaklık kutunun içindeki her şeyi aynı anda etkiler. Birlikte alınmış, birlikte çalışan, birlikte ısınan diskler birlikte ölür.
Bu tam olarak disk diziliminizin sizi korumadığı senaryodur. Bir disk öldüğünde onarım başlar, onarım kalan diskleri zorlar, ve o diskler zaten aynı sıcaklıkta aynı süre yaşamıştır.
Küçük bir sunucuda ısı nereden gelir
Genellikle işlemciden değil. Kapalı bir dolap, tozlanmış bir filtre, aralarında hava boşluğu bırakılmadan üst üste konmuş diskler, ve en yaygını: makinenin havasız bir yere konmuş olması.
Sebebi de hep aynı: gürültü.
Kimsenin planlamadığı takas
Sıra şöyle işliyor. Makine sesli çalışıyor, rahatsız ediyor. Dolaba ya da kilere taşınıyor. Ses sorunu çözülüyor.
Altı ay sonra diskler on derece daha sıcak çalışıyor ve kimse bu iki olayı birbirine bağlamıyor. Çünkü aralarında geçen zaman uzun ve arada hiçbir uyarı çıkmadı.
Makineyi taşıdığınız gün, taşıdığınız yerin hava alıp almadığına bakın. Sonradan bakmak için bir sebebiniz olmayacak.
Ölçülecek sayı tepe değil, süreklilik
Yedek alırken sıcaklığın kısa süre yükselmesi normaldir. Bir anlık tepe değeri size bir şey söylemez.
Anlamlı olan saatlerce durduğu değerdir. Bir sistem gün boyu aynı yüksek sıcaklıkta duruyorsa, kısa bir tepe yapan sistemden çok daha fazla yıpranıyordur.
Ve bir pratik ipucu: tek bir diskin sıcaklığına değil, diskler arasındaki farka bakın. Bir disk komşularından sürekli daha sıcaksa bu bir disk sorunu değil, bir yerleşim sorunudur. O diski yerinden oynatmak, yenisini almaktan ucuzdur.
Atlas ne yapıyor
Atlas her diskin son yirmi dört saatlik sıcaklığını, okuma ve yazma hızlarının yanında gösteriyor. Yani "şu an kaç derece" değil, "gün boyu nerede durdu" sorusuna cevap veriyorsunuz; yukarıdaki ölçüt tam da bu.
Bir tasarım ayrıntısını da söylemek gerekir, çünkü izleme araçlarının sık düştüğü bir tuzağa değiniyor: bu ölçümler yalnızca o diskin kartını açtığınızda çekiliyor. Listede kapalı duran diskler için hiçbir sorgu gitmiyor.
Sebebi basit ve genel bir ilke: sürekli her şeyi sorgulayan bir izleme paneli, kendisi bir yük kaynağına dönüşür. İzleyen şeyin, maliyet çıkaran şey olmaması gerekir.
Kaynaklar
Proxmox'un kendi belgeleri. İngilizce, ve bu konuda son sözü onlar söyler.