Sunucu İzleme Neleri İçerir?
6 Temmuz 2026 tarihinde yayımlandı

Sunucu izleme, bir makinenin ping'e yanıt verip vermediğini kontrol etmekten çok daha fazlasını içerir. Bu yeterli olsaydı, internetin yarısı daha rahat uyurdu. Pratikte iyi izleme, kullanıcılar fark etmeden önce sunucuya ulaşılıp ulaşılamadığını, hizmetlerin sağlıklı olup olmadığını, kaynakların daralmaya başlayıp başlamadığını ve sistemin arızaya doğru sürüklenip sürüklenmediğini izler. Amaç basittir - sorunları erken yakalamak, hızlı yanıt vermek ve hizmeti sakin tutmak.
Gerçek operasyonlarda sunucu izleme neleri içerir?
En azından kullanılabilirlik kontrollerini içerir. Bu, sunucunun kendisinin çevrimiçi olduğunu ve üzerinde çalışan hizmetlerin beklendiği gibi yanıt verdiğini doğrulamak anlamına gelir. Bir web sunucusu çalışıyor olabilirken arkasındaki veritabanı zorlanıyor olabilir ya da müşteriler 502 hataları alırken SSH çalışıyor olabilir. Bu nedenle ciddi izleme yalnızca kutuyu değil, tüm yolu kontrol eder.
Bu yüzden hizmet düzeyi izlemesi önemlidir. Tipik bir iş yükü için bu genellikle HTTP veya HTTPS yanıt kodlarını, SSL sertifikası geçerliliğini, veritabanı erişilebilirliğini, e-posta teslim bileşenlerini, DNS davranışını ve uygulama uç noktalarını izlemek anlamına gelir. Bir çevrimiçi mağaza, bir SaaS uygulaması veya müşteri siteleri işletiyorsanız, soru yalnızca sunucunun var olup olmadığı değildir. Asıl soru, insanların para ödediği hizmetin normal davranıp davranmadığıdır.
Kaynak izleme bir sonraki katmandır. CPU kullanımı, RAM tüketimi, disk alanı, disk I/O, ağ verimi ve load average standart metriklerdir çünkü bunlar sunucunun baskı altında olup olmadığını gösterir. Ancak ham sayılar tek başına yanıltıcı olabilir. Yoğun bir veritabanı sunucusu yüksek CPU ile gayet mutlu çalışabilirken, ani I/O wait yaşayan hafif kullanımlı bir VPS zaten sorun yaşıyor olabilir. İyi izleme yalnızca tek bir kırmızı çizgiyi değil, eğilimleri ve bağlamı okur.
Sunucu izlemenin kapsaması gereken temel alanlar
Çoğu kurulumun başladığı yer sistem sağlığıdır. Bu; uptime, kernel durumu, süreç sağlığı ve donanım veya sanal makine davranışını içerir. Bir VPS'te, guest'in sağlıklı olup olmadığını ve instance içinde kaynak çekişmesi belirtileri bulunup bulunmadığını bilmek istersiniz. Bir adanmış fiziksel sunucuda, RAID durumu, disk hataları, bellek sorunları, güç olayları, sıcaklık ve arayüz sorunları hakkında da görünürlük isteyebilirsiniz. Bunlar gösterişli metrikler değildir, ancak uzun bir akşamı kurtaranlar çoğu zaman bunlardır.
Uygulama izleme daha derine iner. Nginx, Apache, MySQL, PostgreSQL, Redis, Docker konteynerleri veya diğer hizmetlerin gerçekten iyi çalışıp çalışmadığını kontrol eder. Bir süreç, berbat iş çıkarırken de hayatta kalabilir. Bu nedenle izleme genellikle yanıt sürelerini, sorgu gecikmesini, başarısız bağlantıları, kuyruk derinliğini, worker durumunu ve hata oranlarını içerir. Bir uygulama kullanılamaz hâle gelmeden önce yavaşlıyorsa, bunu fark edeceğiniz yer burasıdır.
Depolama izleme, genelde gördüğünden daha fazla saygıyı hak eder. Disk alanının tükenmesi bir sunucuyu bozmanın en eski yollarından biridir ve bir şekilde hâlâ insanları şaşırtır. İzleme, mümkün olan yerlerde toplam kapasiteyi, bölüm kullanımını, inode tüketimini, disk gecikmesini ve SMART göstergelerini takip etmelidir. Yedekleme ağırlıklı sistemler için büyüme kalıpları da önemlidir. Bugün %70 dolu olan bir dosya sistemi kulağa iyi gelebilir, ancak loglar veya medya yüklemeleri hızla artıyorsa gelecek zaten kendini belli ediyordur.
Ağ izleme; bant genişliği kullanımını, arayüz sağlığını, paket kaybını, gecikmeyi, port kullanılabilirliğini ve olağandışı trafik kalıplarını kapsar. Halka açık hizmetler için bu, tıkanıklığı, yanlış yapılandırmayı, upstream sorunlarını veya saldırı etkinliğini ortaya çıkarabilir. Bir sunucu teknik olarak çevrimiçi olsa da müşteri bölgelerinden bakıldığında can sıkıcı derecede yavaşsa, ağ görünürlüğü nedenini açıklamaya yardımcı olur. Loglar da artık aynı hikâyeyi anlatıyor.
Güvenlik izlemesi de resmin bir diğer büyük parçasıdır. Bu, tam kapsamlı bir güvenlik programının yerini almaz, ancak bir şeylerin yolunda gitmediğine dair işaretleri tespit etmelidir. Tipik kontroller arasında başarısız giriş artışları, yetki değişiklikleri, beklenmedik açık portlar, sertifika süresinin dolması, şüpheli süreçler, güvenlik duvarı davranışı ve dosya bütünlüğü uyarıları yer alır. Güncellemeler başarısız olursa veya kritik bir hizmet yanlışlıkla açığa çıkarsa, izleme bunu hızla bildirmelidir.
Uyarılar izlemenin bir parçasıdır, ekstra bir şey değildir
Kimsenin bakmadığı bir pano koruyucu değil, dekoratiftir. Gerçek sunucu izleme, bir eşik aşıldığında veya bir hizmet kontrolü başarısız olduğunda doğru kişileri bilgilendiren uyarı kurallarını içerir. E-posta tek başına acil durumlar için çoğu zaman fazla pasiftir, bu yüzden birçok ekip SMS, sohbet sistemleri, olay araçları veya nöbetçi eskalasyonu kullanır.
Zor kısım uyarı göndermek değildir. Doğru uyarıları göndermektir. Her küçük sıçrama bir bildirim oluşturursa insanlar gürültüyü görmezden gelmeyi öğrenir. Eşikler çok gevşekse, uyarı müşteriler zaten ticket açtıktan sonra gelir. İyi izleme, uyarı hassasiyetini zaman içinde ayarlar; uyarı ve kritik seviyeleri, zaman pencereleri ve bağımlılık mantığını kullanarak tek bir ağ sorununun otuz ayrı panik mesajını tetiklemesini önler.
Gerçek değerin ortaya çıktığı yerlerden biri de yönetilen destektir. Yine de birilerinin sinyale bakması, hizmeti kontrol etmesi ve eylem gerekip gerekmediğine karar vermesi gerekir. Otomasyon faydalıdır, ancak deneyimli operasyonel muhakemenin yerini almaz. Bir sunucu hasta olmadan da gürültülü olabilir ve bazen bunun tersi de doğrudur.
Metrikler, loglar ve kontrollerin her biri farklı bir hikâye anlatır
İnsanlar izlemeyi çoğu zaman tek bir şey gibi ele alır, ancak aslında birbiriyle ilişkili üç iştir. Metrikler, sistemin zaman içinde nasıl performans gösterdiğini anlatır. Loglar, ne olduğunu ayrıntılı biçimde anlatır. Aktif kontroller, bir hizmete dışarıdan veya içeriden ulaşılıp ulaşılamadığını ve çalışıp çalışmadığını doğrular. Daha az kör nokta istiyorsanız üçünün de olması gerekir.
Metrikler eğilimleri tespit etmek için idealdir. Artan bellek kullanımı, yükselen yanıt gecikmesi veya istikrarlı disk büyümesi, arızadan çok önce yaklaşan bir sorunu ortaya çıkarabilir. Loglar teşhise yardımcı olur. Metrik sıçramasının arkasındaki gerçek hata mesajlarını, reddedilen bağlantıları, çökme izlerini ve kimlik doğrulama olaylarını gösterirler. Aktif kontroller, hizmetin kullanıcıların beklediği şekilde yanıt verip vermediğini test ederek herkesin dürüst kalmasını sağlar.
İleri düzey ekipler için bu, çoğu zaman Prometheus uyumlu exporter'lar, Grafana panoları ve uygulama davranışı için özel probe'lar gibi gözlemlenebilirlik araçlarına kadar uzanır. Daha küçük işletmeler için ise yığın daha basit olsa bile ilke aynıdır. Sorunları erken fark edecek kadar görünürlük ve tahmin yürütmeden düzeltecek kadar ayrıntı istersiniz.
Sunucu izlemenin varsayılan olarak içermedikleri
Beklentiler bulanıklaşabildiği için bu bölüm önemlidir. İzleme, bu hizmetler açıkça dahil edilmedikçe otomatik olarak yönetim, düzeltme, yama uygulama, yedekleme doğrulaması veya performans optimizasyonu anlamına gelmez. Bir izleme sistemi bir diskin dolu olduğunu tespit edebilir, ancak alan temizlemek, depolamayı genişletmek veya log rotasyonunu ayarlamak için yine de birinin harekete geçmesi gerekir. Yüksek veritabanı yükünü tespit edebilir, ancak verimsiz bir sorguyu kendi başına yeniden yazmaz.
Ayrıca sıfır kesinti garantisi de vermez. İzleme riski azaltır ve yanıtı hızlandırır; çoğu işletmenin ihtiyaç duyduğu şey de tam olarak budur. Ancak bir sağlayıcı yalnızca uyarıların her kesintiyi önleyeceğini vaat ediyorsa, bu pek de güzel bir teknik ifade değildir. İyi operasyonlar; izleme, yedekler, güncellemeler, mantıklı mimari ve alarm çaldığında ne yapacağını bilen insanlardan oluşur.
Yönetilen sunucu izlemeden ne beklemelisiniz
Yönetilen izleme için ödeme yapıyorsanız, hizmet grafiklerin ötesine geçmelidir. Hizmet kontrolleri, kaynak takibi, uyarılar ve insan incelemesi beklemelisiniz. Ayrıca eskalasyon yolları, yanıt prosedürleri ve neyin tespit edildiğiyle ne yapıldığına dair açık iletişim de beklemelisiniz.
Örneğin, yönetilen bir sağlayıcı artan disk kullanımını tespit edebilir, kaynağını araştırabilir, bayat dosyaları temizleyebilir, hizmet sağlığını doğrulayabilir ve depolamanın genişletilmesi gerekip gerekmediği konusunda tavsiyede bulunabilir. Bir web hizmeti yanıt vermeyi durdurursa, hizmeti yeniden başlatabilir, son logları inceleyebilir, upstream bağımlılıklarını kontrol edebilir ve kararlılık açısından sunucuyu izlemeye devam edebilirler. Değer yalnızca sorunun görülmüş olması değildir. Değer, sabah kahvenizden önce harekete geçilmiş olmasıdır.
Bu, özellikle tüm gece altyapının başında bekleyemeyen ama basit arızalar karşısında da hazırlıksız yakalanmayı göze alamayan ajanslar, SaaS ekipleri ve e-ticaret operatörleri için faydalıdır. İyi bir izleme kurulumu sessizliği bilgiye, bilgiyi de yanıta dönüştürür.
Peki gerçekten neye bakmalısınız?
Kullanılabilirliği, hizmet sağlığını, sistem kaynaklarını, depolamayı, ağ davranışını ve temel güvenlik sinyallerini kapsayan bir izleme arayın. Uyarıların anlamlı olduğundan ve bunlara göre harekete geçmekten birinin sorumlu olduğundan emin olun. Üretim iş yükleri çalıştırıyorsanız, izlemenin uygulama düzeyi kontrolleri içerip içermediğini ve geçmiş metriklerin sorun giderme ile kapasite planlaması için saklanıp saklanmadığını sorun.
Ayrıca tespitten sonra olayların nasıl ele alındığını da sorun. Bu yanıt size özellik listesinden daha fazlasını söyler. İzleme faydalıdır, ancak birçok işletmenin sonunda daha rahat nefes aldığı yer izlenen ve yönetilen yapıdır. kodu.cloud gibi sağlayıcılar, kontrolleri, müdahaleyi, yedeklemeleri ve insan desteğini birbirinden kopuk araçlardan oluşan bir yığından daha az stresli bir çözümde birleştirerek burada değer yaratır.
Sağlıklı bir sunucu, hiç uyarısı olmayan sunucu değildir. Uyarıların erken görüldüğü, doğru anlaşıldığı ve müşteriye yansıyan sorunlara dönüşmeden önce ele alındığı sunucudur. Kabaca işin tamamı budur ve kapsanmış olması çok iyi bir iştir.
Andres Saar Müşteri Hizmetleri Mühendisi