Gözümüz tam olarak nerede oluyor?
İzleme sistemleri, yalnızca sunucuların UP/DOWN durumunu değil, CPU kullanımı, disk doluluk oranı, RAM tüketimi ve ağ paket kaybı gibi performans metriklerini saniyelik aralıklarla kaydeder. Örneğin bir PostgreSQL veritabanının sorgu yanıt süresi aniden 200 ms’yi aştığında sistem otomatik olarak tetiklenir. Bu sayede hangi bileşenin nabzını tuttuğumuzu netleştiririz; sanal sunucularda ise hipervizör seviyesinde VMware vCenter veya Hyper-V logları ayrıca izlenir.
İzleme ihtiyacınızı nasıl belirliyoruz?
İlk adımda mevcut altyapınızdaki tüm donanım (HP, Dell, Supermicro sunucular), ağ ekipmanları (Cisco, Ubiquiti, MikroTik switch/router) ve kritik yazılımların (Exchange, SQL Server, IIS) envanterini çıkarıyoruz. Ardından her bir sistem için normal kabul edilen eşik değerlerini belirliyoruz; örneğin bir web sunucusunun CPU yükünün %80’in üzerine çıkması durumunda uyarı oluşturuyoruz. Bu analiz sonucunda hangi altyapı bileşenlerinde izleme gerektiğini ve öncelik sırasını size detaylı raporluyoruz.
Hangi altyapılar izleme istiyor?
Fiziksel sunuculardan sanal makinelere, ağ yedeklilik katmanlarından SIP trunk gibi iletişim hatlarına kadar tüm katmanlar izlenebilir. Elazığ’da hizmet veren bir çağrı merkezi için VoIP sunucusunun paket gecikmesi ve jitter değerleri ayrıca takip edilmelidir. Ayrıca UPS ünitesinin yükü ve pili, akıllı PDU’ların enerji tüketimi, hatta fiziksel ortamdaki sıcaklık ve nem sensörleri de izleme kapsamımıza girer.
Kurulumdan önce neyi netleştiriyoruz?
Hangi protokollerle iletişim kuracağımızı (SNMP v2c/v3, WMI, IPMI, SSH, API) ve izleme sunucusunun konumlandırılacağı ağı baştan belirleriz. Güvenlik duvarı kurallarını önceden test eder, özellikle SNMP community string’lerinin güçlü parolalarla korunduğundan emin oluruz. Bunun yanında, her bir cihazın izleme frekansı (5 saniye / 1 dakika) ve log tutma süresi (90 gün / 180 gün) gibi parametreleri de müşteriye danışarak sözleşme öncesinde netleştiririz.
Uyarı kime, hangi kanaldan gidiyor?
Kritik seviyedeki bir uyarı (örneğin bir sunucunun erişilemez olması) doğrudan nöbetçi sistem yöneticinize SMS ve telefon ile bildirilirken, düşük öncelikli disk doluluk uyarıları e-posta ile servis masasına iletilir. İzleme arayüzü üzerinde her bir uyarı için hasta, bekleme süresi ve yükseltme politikaları (escalation) tanımlanır. Örneğin 15 dakika içinde aksiyon alınmayan bir kritik uyarı, otomatik olarak üst düzey yöneticiye Slack veya Microsoft Teams kanalı üzerinden yönlendirilir.
Uyarıya nasıl ve ne zaman müdahale ediyoruz?
Bir uyarı geldiğinde önce kaynağı tespit eder, ardından logları ve anlık metrikleri analiz ederiz. Örneğin bir VMware ESXi sunucusunda disk IOPS değeri aniden 5000’e fırladıysa, hangi sanal makinenin yoğun I/O yaptığını belirler ve gerekirse belleğini artırmak için canlı migrasyon başlatırız. Müdahale sürecimiz SLA’ya göre 7/24 30 dakika içinde ilk aksiyonu alacak şekilde kurgulanmıştır ve her adım ayrıntılı olarak olay kaydına işlenir.
Raporlamada hangi KPI'ları takip ediyoruz?
Her ay sonu, ay boyunca alınan uyarılar, çözüm süreleri, en çok kesinti yaşanan bileşen ve sistem kullanım grafiklerini içeren bir performans raporu hazırlıyoruz. Rapor içinde MTTR (Ortalama Onarım Süresi) ve uptime yüzdesi gibi KPI’lar net biçimde gösterilir. Bu veriler, altyapı yatırım kararlarınızda somut dayanak olarak kullanılır.
İzleme maliyeti hangi faktörlere göre değişir?
Ücretlendirme, izlenen cihaz sayısına (node sayısı), kullanılan izleme yazılımının lisans modeline (Nagios XI, Zabbix, PRTG) ve ek entegrasyon ihtiyacına bağlı olarak değişir. Elazığ’daki bir KOBİ için aylık ortalama 4 sunucu ve 8 ağ cihazının takibi, standart konfigürasyonla 350 TL ila 600 TL arasında başlangıç maliyeti oluşturur. Kurulum ve eğitim ücreti tek seferlik olup, sözleşme süresine göre indirim opsiyonu sunarız.
Bu Konuda Yazdıklarımız nerede?
Altyapı izleme ile ilgili teknik karşılaştırmalar, vaka analizleri ve kurulum rehberlerini blog sayfamızda yayınlıyoruz. Örneğin ‘SNMP v2c vs v3: Hangisini ne zaman kullanmalı?’ ya da ‘Elazığ’da bir çağrı merkezinde kesinti nasıl önlendi’ başlıklı yazılarımızda detaylı uygulama örnekleri bulabilirsiniz. Tüm yazılarımıza ana menüdeki ‘Kaynaklar’ bölümünden ulaşabilirsiniz.