
Monitoring, yalnızca çok sayıda grafik toplamak değildir. İyi bir izleme sistemi; hizmet erişilebilir mi, normal hızda mı yanıt veriyor, kaynaklar limite yaklaşıyor mu ve sorun başlamadan önce ne değişti sorularına cevap vermelidir.
CPU: tek bir yüksek yüzdeye takılmayın
Kısa süreli CPU sıçramaları normal olabilir. Daha önemli olan uzun süren saturation ve run queue davranışıdır. Mümkünse hangi processlerin CPU kullandığını ve I/O wait değerlerini de izleyin.
RAM: kullanılan bellek ile bellek baskısını ayırın
İşletim sistemleri boş RAM'i cache için kullanır; bu yüzden yüksek kullanılan RAM her zaman problem değildir. Available memory, swap aktivitesi, OOM olayları ve süreçlerin büyüme trendi daha anlamlı sinyallerdir.
Disk: kapasite kadar gecikmeyi de izleyin
Filesystem kullanımını ve inode durumunu takip edin. Veritabanı veya yoğun I/O yapan uygulamalarda disk latency ve queue değerleri de önemlidir. Uyarıyı disk %100 olmadan önce verin; dolu disk database, log ve güncelleme işlemlerini bozabilir.
Ağ: trafik, hata ve erişilebilirlik
Interface trafiği, paket drop/error ve dışarıdan erişim testlerini takip edin. Yüksek trafik tek başına problem değildir; beklenmeyen ani değişimler veya düzenli paket kaybı incelenmelidir.
Makineyi değil hizmeti de izleyin
CPU ve RAM normal görünürken uygulama 500 hatası döndürebilir. HTTP status, response time, veritabanı bağlantısı, queue durumu ve TLS sertifika süresi gibi servis seviyesinde kontroller ekleyin.
Metric ile logları birlikte kullanın
Metric bir şeyin değiştiğini gösterir; log çoğu zaman nedenini açıklar. Sistem, web server, uygulama ve authentication loglarını doğru zaman damgasıyla saklayın. Birden fazla sunucu varsa merkezi loglama faydalıdır.
İşe yarayan alert üretin
Her alertin bir sahibi ve yapılacak ilk işlem adımı olmalıdır. Çok fazla düşük değerli bildirim, kritik uyarıların gözden kaçmasına neden olur. Warning ve critical seviyelerini ayırın, kısa anlık sıçramalarda gereksiz alarm üretmeyin.
- External uptime ve response time
- CPU saturation/load
- Available RAM ve swap
- Disk kapasitesi ve inode
- Gerekirse disk I/O latency
- Network error/drop
- Kritik servis durumu
- Backup job sonucu
- TLS sertifika süresi
VPS veya dedicated sunucuda management pakete açıkça dahil değilse monitoring ve incident response sorumluluğunun kimde olduğunu önceden belirleyin. İlgili kapsamı sunucu yönetimi sayfasından kontrol edebilirsiniz.
Arvexa hosting seçeneklerini karşılaştırın
İhtiyacınıza uygun güncel yapılandırmaları ve sipariş koşullarını inceleyin.
Arvexa hosting seçeneklerini karşılaştırın