Dell PowerStore Failover, tek bir düğmeye basılan tek bir olay değildir; üç katmanda okunur: appliance içi node failover, site arası replication failover ve metro active-active failover. Kısa cevap: tek appliance'da bir node düşerse peer node I/O'yu sürdürür; replication'da planned failover senkronize ve kontrollü, unplanned failover hedef sistemden başlatılır ve reprotect gerekir; metro'da witness + preferred system kararı hangi tarafın host'a yazacağını belirler. Bu yazı birleşik failover playbook'udur; detaylar: Controller Failure, Replication, Active-Active.
Bu rehber özellikle şu ekipler için yazılmıştır:
- PowerStore HA ve DR hedefini operasyon prosedürüne dökmek isteyen storage yöneticileri
- Planned vs unplanned failover farkını netleştirmek isteyen mimari ekipleri
- Metro witness ve preferred site kararını host multipath ile birlikte okuyan operasyonlar
- Failover sonrası reprotect adımını atlayan kurumları uyarmak isteyen BT liderleri
Hızlı Özet
- Failover katmanları: node (appliance içi) · replication (site arası) · metro (active-active çift site).
- Dual-node appliance: bir node arızasında peer devralır; host multipath sağlıklı olmalı.
- Planned replication failover: kullanıcı başlatır, önce sync, I/O durdurulmalı, veri kaybı hedeflenmez.
- Unplanned failover: kaynak erişilemezse hedeften başlatılır; reprotect zorunlu.
- Metro: bidirectional sync, ~96 km / 60 mil; fractured session'da nonpreferred I/O durur.
- Teşhis: Controller Failure. Mimari: Controller Architecture.
İçindekiler
- Failover Ne Demek?
- Üç Failover Katmanı
- Katman 1: Node Failover (Appliance İçi)
- Katman 2: Replication Failover
- Katman 3: Metro Failover
- Host ve Multipath Rolü
- Failover Karar Ağacı
- Yaygın Hatalar
- Kontrol Listesi
- LeonX ile Sonraki Adım
- Sık Sorulan Sorular
- Kaynaklar

Görsel: StorageReview - Dell PowerStore Gen 3 Review (PowerStore 9500 / node ve I/O modülü).
Failover Ne Demek?
PowerStore failover, bir bileşen veya site erişilemez olduğunda iş yükünün alternatif yola (peer node, replication hedefi veya metro preferred system) devredilmesidir. Klasik dual-controller SAN'dan farkı: node, replication session ve metro resource ayrı kavramlardır; aynı prosedür hepsine uygulanmaz.
Kısa tanım: Failover, kesinti anında veri erişiminin tanımlı yedek yola geçmesi; geri dönüş için reprotect veya node join-back adımlarının planlanmasıdır.
Üç Failover Katmanı
| Katman | Kapsam | Tipik tetikleyici | Host etkisi |
|---|---|---|---|
| Node | Tek appliance, 2 node | Node reboot, hardware, join-back | Multipath peer'e kayar |
| Replication | İki PowerStore sistemi | Site kesintisi, bakım | Hedef sisteme map/zoning |
| Metro | Active-active çift site | Link kopması, fractured session | Preferred path aktif kalır |
Mimari temel: PowerStore Nedir?, Active-Active Architecture.
Katman 1: Node Failover (Appliance İçi)
Her base enclosure iki node içerir (Dell Planning Guide). Active-active mimaride bir node servis dışı kalırsa peer node appliance I/O'sunu sürdürmeyi hedefler.
Beklenen davranış:
- Arızalı node alert üretir (
0x00304404,0x00304203vb.) - Peer node normal ise volume erişimi devam eder
- Host tarafında en az bir sağlıklı path kalmalı (FC/iSCSI multipath)
Operasyon notları:
- Peer node sağlıksızken arızalı node'u reboot etmeyin (Dell Reboot Procedures)
- Join-back sorunları PowerStoreOS sürümüne bağlı olabilir — Controller Failure rehberi
- Tek volume aynı anda bir appliance tarafından servis edilir; cluster genişlemesi toplam kapasiteyi artırır, volume'ü her node'a dağıtmaz
Katman 2: Replication Failover
Replication failover site arası senaryolardır. Dell dokümantasyonu iki ana tip tanımlar:
Planned failover
- Kullanıcı tarafından başlatılır
- Önce source ↔ destination senkronizasyon
- Dell: failover öncesi host I/O durdurulmalı
- Session inactive olur; normale dönmek için reprotect (veya auto-reprotect)
Unplanned failover
- Kaynak sistem erişilemez veya arızalı
- Destination sistemden başlatılır
- En güncel kopya veya uygun snapshot kullanılabilir
- Bağlantı dönünce eski source destination moda alınır; reprotect gerekir
| Mod | RPO hedefi | Failover tipi |
|---|---|---|
| Asynchronous | Dakika/saat (RPO rule) | Genelde unplanned veya kontrollü |
| Synchronous | 0 | Planned/unplanned; gecikme kritik |
| Metro | 0 (bidirectional) | Witness + preferred site — Katman 3 |
Derin mod karşılaştırması: Replication Nasıl Çalışır. Snapshot kaynağı: Snapshot.
Katman 3: Metro Failover
Metro protection, iki PowerStore arasında bidirectional synchronous active-active replication kurar (Dell Metro Protection). Host iki fiziksel volume'ü tek metro volume + çoklu path olarak görür.
Failover mantığı:
- Witness ayrı host/VM'de; split-brain kararını destekler
- Preferred system arıza anında host I/O'yu sürdürür
- Fractured session veya bağlantı kopunca nonpreferred taraf I/O'yu durdurur
- Tipik mesafe: 96 km veya 60 mil
Metro ≠ standart sync session; host erişim modeli farklıdır. Mimari derinlik: Active-Active Architecture. PowerStore 4.3+ file sync'te witness ile auto-failover desteği belgelenmiştir.
Host ve Multipath Rolü
Failover storage tarafında başarılı olsa bile host'ta path kaybı kesinti yaratır:
| Protokol | Kontrol |
|---|---|
| Fibre Channel | Zoning, ALUA, host multipath (PowerPath/MPxIO/native) |
| iSCSI | Çoklu NIC/session, subnet/VLAN |
| NAS | DNS, mount point, client timeout |
Failover testi öncesi:
- Tüm hostlarda path sayısı ve health
- Maintenance penceresi ve uygulama quiesce
- PowerStore Manager'da replication/metro session durumu
- Failover sonrası volume görünürlüğü — Volume Not Visible
Pro Tip: İlk failover'ı production'da değil, DR tatbikatında yapın; reprotect ve host remap adımlarını yazılı prosedürle doğrulayın.
Failover Karar Ağacı
| Durum | Gidin |
|---|---|
| Tek node alert, peer sağlıklı | Controller Failure — genelde otomatik devralma |
| Planlı site bakımı | Replication planned failover + I/O stop + reprotect |
| Kaynak site tamamen down | Unplanned failover + host remap + reprotect |
| Metro link koptu | Witness/preferred kontrol; Active-Active |
| Failover sonrası latency | High Latency |
Yaygın Hatalar
- Node failover ile replication failover'ı karıştırmak
- Planned failover'da I/O durdurmadan başlamak
- Reprotect adımını atlamak
- Metro'da witness'ı metro sistemlerinden birinde çalıştırmak
- Host multipath test etmeden DR'ye güvenmek
- Failover = "geri dönüş gerekmez" sanmak
Kontrol Listesi
- Failover katmanı (node / replication / metro) tanımlandı.
- RPO/RTO hedefi yazılı.
- Planned failover: I/O durdurma prosedürü hazır.
- Unplanned failover: hedef sistem ve host remap planı var.
- Reprotect / auto-reprotect kararı alındı.
- Metro: witness ayrı host/VM, preferred site belirlendi.
- Host multipath tüm sunucularda doğrulandı.
- DR tatbikatı tarihi planlandı.
- Failover sonrası volume/host kontrol listesi yazıldı.
- İlgili derin rehbere yönlendirme not edildi.
LeonX ile Sonraki Adım
LeonX, PowerStore failover tasarımında NAS/SAN Depolama Kurulum ve Yapılandırma ile replication/metro topolojisi, witness yerleşimi, host multipath ve DR tatbikatı planlar. Keşif için İletişime Geçin.
Sık Sorulan Sorular
PowerStore failover otomatik mi?
Node seviyesinde peer devralma genelde otomatiktir (peer sağlıklıysa). Replication planned failover manueldir; unplanned failover operatör veya (metro file sync + witness ile) otomatik tetiklenebilir. Her katman farklıdır.
Planned ve unplanned failover farkı nedir?
Planned: kontrollü, önce sync, I/O durdurma, veri kaybı hedeflenmez. Unplanned: kaynak erişilemez, hedeften başlatılır, reprotect gerekir.
Metro failover'da witness zorunlu mu?
Metro session için Dell witness service önerir; split-brain ve preferred system kararı için kritiktir. Witness metro node'larında çalışmamalıdır.
Failover sonrası ne yapmalıyım?
Replication/metro failover sonrası reprotect ile yönü normale döndürün; host path ve volume mapping doğrulayın. Node failover sonrası arızalı node join-back ve alert temizliği — Controller Failure.
Active-active ile node failover aynı mı?
Hayır. Appliance içi active-active iki node'un HA'sıdır. Metro active-active iki sistem arası bidirectional erişim modelidir.


