Sunucu & Sanallaştırma

Felaket Kurtarma (Disaster Recovery) Çözümleri

RTO ve RPO hedeflerinin belirlenmesi, kritik sistem önceliklendirmesi, ikinci lokasyon kopyası, sanal makine replikasyonu ve periyodik geri dönüş tatbikatları.

Yedek almak tek başına yeterli değildir. Asıl soru şudur: bir felaket anında sistemleriniz ne kadar sürede ve hangi ana kadarki veriyle ayağa kalkar? Bu iki soruya net bir yanıt verilemiyorsa, elinizde bir yedekleme sistemi vardır ama bir felaket kurtarma planınız yoktur.

Bu hizmetin işletmenize faydaları

Felaket kurtarma planlaması, belirsiz bir güven duygusunu ölçülebilir hedeflere dönüştürür. Hangi sistemin kaç saatte ayağa kalkacağı, ne kadar veri kaybının göze alındığı ve bu hedeflere ulaşmak için hangi altyapının gerektiği yazılı hâle gelir.

İkinci fayda maliyet netliğidir. Tüm sistemleri en yüksek koruma seviyesinde tutmak gereksiz pahalıdır; hiçbirini korumamak ise risklidir. Önceliklendirme, bütçenin gerçekten kritik olan sistemlere yönlendirilmesini sağlar. Üçüncüsü ise tatbikattır: plan yalnızca kâğıt üzerinde kalmaz, çalıştığı düzenli olarak kanıtlanır.

Hangi sorunları çözüyoruz?

  • Belirsiz kurtarma süresi: Kesinti anında ne kadar sürede dönüleceğinin bilinmemesi.
  • Test edilmemiş yedekler: Yedeklerin alındığı ama hiç geri dönülmediği kurgular.
  • Tek lokasyon riski: Tüm kopyaların aynı binada bulunması.
  • Fidye yazılımının yedeklere ulaşması: Ağdan erişilebilen yedeklerin de şifrelenmesi.
  • Yazılı prosedür eksikliği: Kriz anında kimin ne yapacağının belli olmaması.
  • Bağımlılık haritası olmaması: Hangi sistemin hangi sırayla ayağa kaldırılacağının bilinmemesi.

Hizmet kapsamı

  • RTO (kurtarma süresi) ve RPO (kabul edilebilir veri kaybı) hedeflerinin belirlenmesi
  • Kritik sistemlerin önceliklendirilmesi ve bağımlılık haritasının çıkarılması
  • Yerinde ve ikinci lokasyon / bulut kopyalarının kurgulanması
  • Sanal makine replikasyonu ve hızlı devreye alma senaryoları
  • Fidye yazılımına karşı değiştirilemez (immutable) yedek katmanı
  • Yazılı felaket kurtarma prosedürü ve rol dağılımı
  • Periyodik geri dönüş tatbikatları ve sonuç raporlaması
  • Altyapı değişikliklerinde planın güncellenmesi

Nasıl çalışıyoruz?

  1. Envanter ve etki analizi: Sistemler listelenir; her birinin durması hâlinde işin nasıl etkileneceği değerlendirilir.
  2. Hedef belirleme: Kritik, önemli ve ertelenebilir gruplar için ayrı RTO ve RPO değerleri kararlaştırılır.
  3. Tasarım: Bu hedefleri karşılayacak yedekleme sıklığı, replikasyon yöntemi ve ikinci lokasyon kurgusu planlanır.
  4. Uygulama: Yedekleme ve replikasyon devreye alınır, değiştirilemez katman eklenir.
  5. Prosedür yazımı: Kim, hangi sırayla, hangi adımı uygulayacak; iletişim akışı nasıl işleyecek belgelenir.
  6. Tatbikat: Kritik bir sistem izole ortamda ayağa kaldırılır, süre ölçülür ve hedefle karşılaştırılır.

Kimler için uygundur?

Kesintinin doğrudan gelir kaybına dönüştüğü işletmeler, müşteri verisi barındıran kurumlar, üretim veya lojistik süreçleri yazılıma bağlı firmalar ve iş sürekliliği konusunda sözleşmesel yükümlülüğü olan şirketler bu hizmetin kapsamındadır.

Daha önce ciddi bir kesinti veya veri kaybı yaşamış işletmeler için de uygundur; bu vakalarda planlama genellikle yaşanan olayın nedenlerinin analiziyle başlar.

Teknik detaylar

  • Yedekleme ve replikasyon: Veeam Backup & Replication, Acronis Cyber Protect
  • Sanallaştırma: VMware vSphere ve Microsoft Hyper-V ortamlarında replikasyon
  • Hedef ortamlar: Yerel depolama, NAS, ikinci lokasyon ve bulut arşivi
  • Fidye yazılımı koruması: Değiştirilemez depolama, ayrı kimlik doğrulama, çevrimdışı kopya
  • Tatbikat: İzole test ortamında geri dönüş, süre ölçümü ve sonuç raporu
  • Belgelendirme: Yazılı prosedür, rol dağılımı, iletişim listesi ve bağımlılık haritası

Not: RTO ve RPO değerleri işletmenin ihtiyacına ve seçilen altyapıya göre belirlenir; sözleşmede tanımlanan hedefler esas alınır.

SSS

Sık Sorulan Sorular

Yedeğim var, felaket kurtarma planına neden ihtiyacım olsun?
Yedek almak veriyi saklar; felaket kurtarma planı ise sistemleri hangi sırayla ve ne kadar sürede ayağa kaldıracağınızı tanımlar. Test edilmemiş yedeklerin geri dönmediği durumlar sahada sık karşılaşılan bir sorundur.
RTO ve RPO ne anlama geliyor?
RTO, bir kesinti sonrası sistemlerin ne kadar sürede çalışır hâle geleceğini; RPO ise kabul edilebilir azami veri kaybı süresini ifade eder. Bu iki hedefi işinizin gerçek ihtiyacına göre birlikte belirliyoruz.
Tatbikatlar ne sıklıkla yapılmalı?
Kritik sistemler için yılda en az iki kez geri dönüş tatbikatı öneriyoruz. Altyapıda önemli bir değişiklik olduğunda ek tatbikat planlıyoruz, çünkü değişiklik çoğu zaman planı geçersiz kılar.
Tüm sistemler aynı korumaya mı alınıyor?
Hayır. Sistemler kritiklik düzeyine göre gruplanır ve her gruba ayrı hedef belirlenir. Bu yaklaşım hem gereksiz maliyeti hem de yetersiz korumayı önler.