Önemli Olan Prometheus Grafana Hosting Metrikleri
12 Mayıs 2026 tarihinde yayımlandı

Sunucunuz, ödeme adımı yavaşlayana, PHP worker'ları birikene veya bir düğüm sabah 3:12'de disk alanını bitirene kadar "iyi" hissettiriyorsa, önce bir hosting sorununuz yoktur - bir görünürlük sorununuz vardır. Prometheus Grafana hosting metrikleri, operasyon ekiplerinin gerçekten ihtiyaç duyduğu görünümü sağlar: ne yoğun, ne başarısız oluyor, ne başarısız olmaya yakın ve kullanıcılar fark etmeden önce ne değişti.
Hosting ortamları için bu, gösterişli grafiklerden daha önemlidir. Bir VPS, managed VPS veya dedicated server, CPU steal sıçramaları yaşanırken, I/O wait artarken, bellek baskısı oluşurken veya veritabanı gecikmesi sapmaya başlarken dışarıdan sağlıklı görünebilir. Uptime kontrolleri şikâyet etmeye başladığında, zarar zaten başlamış olur. Metrikler, sorunların şeklini daha erken, hâlâ küçük ve düzeltilebilirken yakalamanızı sağlar.
prometheus grafana hosting metrikleri ne göstermeli
Yararlı bir kurulum, sıkıcı gerçeklerle başlar. Host'un erişilebilir olup olmadığını, kaynakların baskı altında olup olmadığını ve iş yükünün normal davranıp davranmadığını bilmeniz gerekir. Bir pano bu üç şeyi bir dakikadan kısa sürede yanıtlayamıyorsa, süsten ibarettir.
Prometheus, exporter'lardan ve servislerden zaman serisi verilerini toplar. Grafana, bu verileri kahvesi olan ama belki de yeterince kahvesi olmayan insanlar için yeterince okunabilir hâle getirir. Birlikte, hosting için pratik bir uyum sağlarlar çünkü altyapıyı ve uygulamaları aynı yerde izleyebilirler.
Altyapı katmanında temel metrikler CPU kullanımı, load, bellek tüketimi, swap etkinliği, disk alanı, disk I/O, dosya sistemi inode'ları, ağ throughput'u, paket hataları ve uptime'dır. Bunlar gösterişli değildir, ancak gerçek olayların çok büyük bir bölümünü açıklar. Düşük load ile yüksek CPU, boşta CPU ile yüksek load'dan farklı bir anlama gelir. Serbest bellek sakin görünebilir, ta ki page fault'lar ve swap diğer hikâyeyi anlatmaya başlayana kadar. Log'lar şimdi aynı hikâyeyi anlatıyor, ancak metrikler bunu daha erken anlatır.
Servis katmanında, para kazandıran veya işin devam etmesini sağlayan yazılımdan metrikler istersiniz. Web stack'leri için bu genellikle Nginx veya Apache istek oranları, durum kodu dağılımı, aktif bağlantılar, upstream yanıt süresi ve TLS sonlandırma davranışı anlamına gelir. Veritabanları için sorgu gecikmesi, bağlantı kullanımı, cache hit oranı, replication lag ve depolama büyümesi, genel bir yeşil onay işaretinden daha önemlidir. Container'lar için bu genellikle container yeniden başlatmaları, bellek limitleri, CPU throttling ve servis başına saturation'dır.
Hosting ekipleri neden Prometheus ve Grafana'yı birlikte kullanır
Prometheus, metrikleri verimli şekilde toplama ve depolama konusunda çok iyidir. Ayrıca ciddi operasyon çalışmaları için yeterince güçlü alerting mantığına da sahiptir. Grafana, bu metriklerin, her sorguyu ezbere hatırlayan tek mühendisten daha fazla kişi için operasyonel olarak faydal ı hâle geldiği yerdir.
Bu eşleşme özellikle hosting'de iyi çalışır çünkü ortamlar karmadır. Bir müşterinin managed VPS üzerinde tek bir WordPress örneği olabilir. Bir diğeri özel ağ üzerinden birkaç API, Redis ve bir veritabanı kümesi çalıştırır. Basitten yoğuna ölçeklenebilen, daha sonra sizi tam bir yeniden tasarıma zorlamayan tek bir monitoring düzeni istersiniz.
Bir de güven faktörü vardır. Müşteriler yalnızca bir host'un çevrimiçi olduğunu bilmek istemez. Sunucularının soruna yakın olup olmadığını, kullanımın bir yükseltmeye doğru eğilim gösterip göstermediğini ve bir destek mühendisinin hızlı hareket etmek için yeterli veriye sahip olup olmadığını bilmek isterler. Metrikler tahmini azaltır. Ayrıca herkesin ağdan şüphelendiği, ama gerçek sorunun dolu bir disk ve 900.000 cache dosyası olduğu o hafif can sıkıcı destek görüşmesini de azaltır.
Gerçek hosting'de en önemli metrikler
Bazı sayılar diğerlerinden daha değerlidir çünkü doğrudan eyleme işaret ederler. CPU utilization faydalıdır, ama CPU saturation genellikle daha faydalıdır. Çekirdekleriniz meşgulse ve run queue uzunluğu artıyorsa, kullanıcılar bunu hisseder. CPU, yedekleme veya indeksleme işi planlandığı gibi çalıştığı için yüksekse ve gecikme sabitse, bu daha az dramatiktir.
Bellek metrikleri de aynı bağlama ihtiyaç duyar. Toplam kullanılan bellek, sistem sağlıklı olsa bile Linux'ta endişe verici görünebilir. Daha önemli olan kullanılabilir bellek, swap etkinliği, major page fault'lar ve uygulamanızın OOM killer tarafından öldürülmeye başlayıp başlamadığıdır. Bu bir kez görünürse, bu bir uyarıdır. İki kez görünürse, sunucu çok doğrudan bir şekilde yardım istiyor demektir.
Disk metrikleri, genellikle gördüklerinden daha fazla saygıyı hak eder. Kapasite kullanımı bunun yalnızca bir parçasıdır. Disk latency, queue depth, okuma/yazma IOPS ve inode tüketimi, disk teknik olarak dolmadan önce bile bir servisi bozabilir. Hiçbir şey paylaşılmıyor, tam panik - amaç bu değil. Sağlıklı bir hosting panosu, hem ne kadar depolama kaldığını hem de depolama alt sisteminin şu anda zorlanıp zorlanmadığını göstermelidir.
Ağ metrikleri, sunucu sorunları ile trafik sorunlarını ayırmaya yardımcı olur. Throughput, düşen paketler, yeniden iletimler ve arayüz hataları, hattın baskı altında mı yoksa kirli mi olduğunu söyler. Yanıt süresi sistem kaynakları normalken sıçrıyorsa, ağ davranışı daha ilginç hâle gelir. Yanıt süresi I/O wait ve veritabanı kilit çekişmesiyle birlikte sıçrıyorsa, bu kez ağ muhtemelen masumdur.
Sonra uygulama metrikleri gelir; hosting'in iş farkındalığı kazandığı yer burasıdır. Bir site sahibi yalnızca CPU'yu değil, sipariş tamamlama süresini önemser. Bir SaaS operatörü queue depth, iş başarısızlıkları ve API gecikme yüzdeliklerini önemser. Birkaç müşteri sitesini yöneten bir dijital ajans en çok yavaş cron işleri, başarısız yedeklemeler, SSL sona erme aralıkları ve kampanya lansmanından sonra ani trafik değişiklikleriyle ilgilenebilir. İyi prometheus grafana hosting metrikleri, sistem sağlığını müşteri etkisine bağlar.