
Bir sunucunun ping’e cevap vermesi, uygulamanın gerçekten sağlıklı çalıştığı anlamına gelmez. Production ortamında kritik olan şey; uygulamanın cevap vermesi, diskin dolmaması, SSL sertifikasının süresinin bitmemesi, yedeklerin gerçekten alınması ve zamanlanmış görevlerin sessizce hata üretmemesidir. Bu nedenle production sunucu izleme sadece CPU/RAM grafiği izlemekten ibaret değildir.
Bu rehber, KOBİ, SaaS, e-ticaret ve yazılım ekipleri için pratik bir sunucu izleme kontrol listesi sunar. Amaç karmaşık bir monitoring mimarisi anlatmak değil; gözden kaçtığında gerçek kesinti veya veri kaybı yaratabilecek noktaları netleştirmektir.
1. HTTP ve uygulama sağlık kontrolü
İlk kontrol, uygulamanın dışarıdan gerçekten cevap verip vermediğidir. Ancak sadece ana sayfanın 200 dönmesi de yeterli olmayabilir. SaaS veya panel uygulamalarında login sayfası, API health endpoint’i veya kritik servislerin basit bir sağlık endpoint’i ayrıca izlenmelidir.
- Ana domain HTTP/HTTPS kontrolü
- API veya panel health endpoint kontrolü
- Yanıt süresi takibi
- Belirli hata kodları için alarm
- Cloudflare/CDN varsa origin kontrolü
2. Disk doluluğu ve log büyümesi
Production sunucularda en sık görülen sessiz problemlerden biri disk doluluğudur. Uygulama logları, veritabanı dump dosyaları, geçici upload klasörleri veya eski backup arşivleri zamanla diski doldurabilir. Disk tamamen dolduğunda veritabanı yazamaz, oturumlar bozulabilir veya uygulama beklenmedik hatalar verebilir.
Bu yüzden disk kullanımında tek bir kritik eşik yerine uyarı ve kritik seviye tanımlamak daha doğru olur. Örneğin yüzde 75 uyarı, yüzde 85 kritik alarm gibi basit bir yaklaşım bile birçok problemi büyümeden yakalar.
3. SSL sertifika süresi takibi
SSL sertifikası süresi dolduğunda site teknik olarak ayakta olsa bile kullanıcı tarafında güvenlik uyarısı görünür. Bu durum özellikle ödeme alan, müşteri paneli sunan veya form toplayan işletmeler için güven kaybı yaratır. Otomatik yenileme kullanılsa bile yenilemenin başarısız olabileceği unutulmamalıdır.
SSL takibi için sertifika bitiş tarihine belirli günler kala alarm üretilmeli, otomatik yenileme logları da düzenli kontrol edilmelidir.
4. Yedek alındı mı, yoksa sadece planlandı mı?
Yedekleme sistemlerinde en tehlikeli varsayım “zaten otomatik yedek var” düşüncesidir. Asıl izlenmesi gereken şey yedek job’ının başarılı bitip bitmediği, dosyanın gerçekten oluşup oluşmadığı ve geri yükleme için kullanılabilir olup olmadığıdır.
- Son yedek zamanı
- Yedek dosya boyutu
- Yedek job exit durumu
- Uzak depolamaya aktarım sonucu
- Periyodik geri yükleme testi
5. Cron job ve zamanlanmış görev izleme
Birçok uygulamada fatura üretimi, e-posta gönderimi, rapor oluşturma, veri senkronizasyonu veya entegrasyon işleri cron job’larla çalışır. Bu işler hata verdiğinde ana uygulama açık görünmeye devam edebilir; fakat iş süreçleri arkada durur. Bu yüzden cron job takibi production izleme planının ayrı bir başlığı olmalıdır.
6. Alarm kanalı ve sorumluluk
Monitoring kurmak kadar alarmın kime, ne zaman ve hangi öncelikle gideceği de önemlidir. Her uyarı aynı kanala düşerse zamanla alarm körlüğü oluşur. Kritik servis kesintisi, disk doluluğu, SSL süresi ve yedek hatası gibi konular için öncelik seviyesi belirlenmelidir.
Narweb DevOps Hizmeti ile izleme planı
Narweb’in DevOps Hizmeti, production sunucu ve uygulama altyapılarında izleme, alarm, bakım, deploy ve operasyon süreçlerinin daha düzenli hale getirilmesine yardımcı olabilir. Mevcut VDS, cloud dedicated veya Kubernetes altyapınızda hangi kontrollerin eksik olduğunu birlikte değerlendirmek mümkündür.
Eğer sunucunuz “çalışıyor gibi” görünse de yedek, SSL, cron veya disk tarafında görünmeyen riskler olup olmadığını kontrol etmek istiyorsanız, Narweb ile mevcut altyapınız için pratik bir izleme kontrol listesi çıkarabilirsiniz.

Bir yanıt yazın