1. Proje Özeti ve Müşteri Profili
7 gün 24 saat kesintisiz hasta kabulü, laboratuvar sonuçları ve medikal görüntüleme (PACS) servisleri sunan bir özel sağlık kuruluşu, donanım arızalarında dahi hizmetin durmayacağı yüksek erişilebilirlikli (High Availability - HA) bir altyapıya ihtiyaç duydu.
Mevcut sistemde sunuculardan biri arızalandığında ilgili sanal makinelerin manuel olarak diğer sunucuya taşınması saatler sürmekte ve operasyon kilitlenmekteydi.
[ ESKİ DÜZEN ] : Bağımsız Sunucular ──> Sunucu Çökünce Manuel Müdahale ──> 4-6 Saat Kesinti
[ YENİ MİMARİ ]: 3-Node Proxmox VE HA Kümesi ──> Ceph NVMe Havuzu ──> <30 Saniye Otomatik Failover
2. Karşılaşılan Kritik Altyapı Problemleri
- Donanım Arızasında Manuel Müdahale Zorunluluğu: Gece yarısı bir fiziksel sunucunun anakartı veya güç kaynağı arızalandığında sistem otomatik devreye giremiyordu.
- Paylaşımlı Depolama Darboğazı: Eski NAS cihazı üzerindeki HDD diskler IOPS darboğazı yaratıyor, veritabanı sorguları yavaşlıyordu.
- Felaket Kurtarma (DR) Yokluğu: Ana veri merkezinde yangın veya su basması gibi fiziksel bir felaket anında devreye girecek ikincil bir lokasyon bulunmuyordu.
3. Uygulanan Mimari Çözüm ve Adımlar
Aşama 1: 3 Node'lu Proxmox VE Yüksek Erişilebilirlik (HA) Kümesi
- 3 adet kurumsal sunucu 10GbE SFP+ doğrudan fiber bağlantılarla birbirine bağlandı.
- Corosync quorum mekanizması ile cluster mimarisi kuruldu.
- Bir sunucu fiziksel olarak kapandığında veya arızalandığında, üzerindeki kritik VM'lerin 30 saniye içinde diğer sunucularda otomatik ayağa kalkması sağlandı.
Aşama 2: Ceph Dağıtık ve Yedekli Depolama (Distributed SAN)
- Harici pahalı SAN üniteleri yerine sunucuların içindeki kurumsal NVMe diskler Ceph Storage Cluster havuzunda birleştirildi.
- Veriler her an 3 sunucuya eşzamanlı (3x replication) yazılarak tek bir disk veya tüm sunucu yansa dahi sıfır veri kaybı garantilendi.
Aşama 3: İkincil Lokasyon Felaket Kurtarma (Off-Site DR)
- Farklı bir coğrafi lokasyonda Proxmox Backup Server (PBS) kurularak günlük değişen bloklar (incremental deduplicated) şifreli VPN tüneli üzerinden felaket kurtarma merkezine replike edildi.
4. Elde Edilen Ölçülebilir Sonuçlar
| Metrik | Proje Öncesi | Proje Sonrası | İyileşme |
|---|---|---|---|
| Donanım Arıza Kesintisi | 4–6 Saat | < 30 Saniye (Otomatik) | %99.8 Kesinti Azalması |
| Depolama IOPS Performansı | ~1.200 IOPS | > 45.000 IOPS | 35 Kat Hız Artışı |
| Felaket Kurtarma (DR) | Sıfır Güvence | Tam Replikasyon | %100 İş Sürekliliği |
| Lisanslama Maliyeti | Yüksek VMware lisansı | %60 Tasarruf (Açık Kaynak) | Büyük Bütçe Avantajı |
5. Kullanılan Teknolojiler
- Hypervisor & Cluster: Proxmox VE 8.2 (Debian Bookworm)
- Depolama Teknolojisi: Ceph Reef 18.2, ZFS Storage Engine
- Yedekleme & Replikasyon: Proxmox Backup Server, WireGuard VPN
- Ağ Altyapısı: Mellanox ConnectX-3 10GbE SFP+ Çift Hat Bağlantı
Sanallaştırma Altyapınızı Güçlendirmek İster Misiniz?
Şirketiniz için Proxmox HA kümesi kurmak, Ceph depolama tasarlamak veya VMware'den açık kaynak sanallaştırmaya geçiş yapmak isterseniz sanallaştırma çözümlerimi ve sistem yönetimi hizmetlerimi inceleyebilir veya benimle iletişime geçebilirsiniz.