Dell Server Disk Failure durumunda doğru sıra, panik halinde yanlış diski çekmekten daha kritiktir. Kısa cevap: Önce iDRAC veya ön panel LED ile slotu ve Physical Disk durumunu sabitleyin; Virtual Disk’in Degraded mi Offline mi olduğunu doğrulayın; yedekleme ve yedek parça eşleşmesini kontrol edin; ancak ondan sonra hot-swap yapın. Bu yazı, mevcut Disk Failure Hatası rehberinin olay anı playbook’udur: ilk 15 dakika, şiddet matrisi, RAID karar ağacı ve “çekme / çekme” kuralları.
Bu playbook özellikle şu ekipler için yazılmıştır:
- Gece/hafta sonu disk alarmı alan sistem yöneticileri
- PERC/iDRAC üzerinden Failed veya Predictive Failure gören altyapı ekipleri
- Hot spare’siz ortamda ilk müdahaleyi standartlaştırmak isteyen kurumlar
- Yanlış disk çekme riskini prosedürle azaltmak isteyen operasyon ekipleri
Hızlı Özet
- İlk hedef: doğru slot + Virtual Disk durumu + yedek bütünlüğü.
Failed≠Predictive Failure(PDR16); müdahale temposu farklıdır.- RAID 1/5/6/10’da tek disk kaybı çoğu zaman
Degraded; RAID 0 veya ikinci disk kaybıOfflineolabilir. - Yedek disk: aynı kapasite, medya tipi, arayüz ve tercihen aynı hız sınıfı.
- Hot-swap öncesi LED + iDRAC slotunu iki kez doğrulayın.
- Rebuild bitmeden “sorun bitti” demeyin; VD
Optimalolmalı. - Teknik adımlar: Disk Failure Hatası.
İçindekiler
- İlk 15 Dakika
- Şiddet Matrisi: Failed, Predictive, Degraded, Offline
- RAID Karar Ağacı
- Yedek Disk Eşleştirme Kontrolü
- Ne Zaman Hot-Swap Yapılır?
- Predictive Failure (PDR16) Özel Yol
- Çoklu Disk veya Offline Virtual Disk
- Rebuild Sonrası Doğrulama
- Yaygın Hatalar
- Kontrol Listesi
- Sık Sorulan Sorular
- Kaynaklar

Görsel: StorageReview - Dell EMC PowerEdge R740xd NVMe Server Review (PowerEdge ön disk bayları).
İlk 15 Dakika
Olay anında sırayı bozmayın:
- Alarmı sınıflandırın. iDRAC Lifecycle Log / Storage: Failed mi, Predictive Failure mi?
- Slotu sabitleyin. Physical Disk listesinden
Enclosure:Bayveya slot numarasını not edin. - Seri numarası ve kapasiteyi yazın. Tedarik ve garanti için gerekli.
- Virtual Disk durumuna bakın.
Optimal,Degraded,Failed/Offline? - Hot spare var mı? Global/dedicated spare rebuild’i otomatik başlatmış olabilir.
- Yedekleme penceresini doğrulayın. Son başarılı backup zamanı ve restore test notu.
- SupportAssist / controller log dışa aktarın. Özellikle Predictive ve tekrarlayan alarmlarda.
Pro Tip: Fiziksel LED kehribar yanıp sönüyorsa bile, iDRAC slot numarası olmadan kızak çekmeyin. Yanlış sağlam disk, RAID 5’i Offline’a götürebilir.
iDRAC temeli: iDRAC Nedir?.
Şiddet Matrisi: Failed, Predictive, Degraded, Offline
| Durum | Anlamı | Tempo |
|---|---|---|
| Predictive Failure (PDR16) | Disk yakında arızalanabilir; hâlâ Online olabilir | Aynı gün planlı değişim |
| Physical Disk Failed | Disk RAID’den düştü | Acil yedek + hot-swap |
| Virtual Disk Degraded | Yedeklilik azaldı; veri genelde erişilir | Spare ile rebuild; ikinci arızaya izin yok |
| Virtual Disk Offline/Failed | VD erişilemez | Çekme yok; recovery/yedekten geri dönüş |
Dell, Predictive Failure için önce yedek alınmasını, SupportAssist koleksiyonu çıkarılmasını ve gerekirse firmware güncellemesinin değerlendirilmesini önerir; çoklu diskte PDR16 görülürse destek çağrısı doğru adımdır.
RAID Karar Ağacı
| Virtual Disk / RAID | Tek disk kaybı | İkinci disk kaybı |
|---|---|---|
| RAID 0 | Offline / veri riski | — |
| RAID 1 / 10 | Degraded; hot-swap + rebuild | Kritik; Offline riski |
| RAID 5 | Degraded | Offline |
| RAID 6 | Genelde hâlâ yedekli (1 kayıp) | İkinci kayıpta Degraded |
RAID tasarımı: RAID Configuration Best Practices. Disk türü seçimi: SAS vs SATA vs NVMe.
Kısa tanım: Disk Failure durumunda yapılacak ilk iş hot-swap değil; Virtual Disk’in hâlâ tolerans içinde olup olmadığını ve doğru fiziksel slotu doğrulamaktır.
Yedek Disk Eşleştirme Kontrolü
Yanlış parça, rebuild’i başlatmaz veya Foreign/Ready’de takılı kalır.
Sipariş / stok kontrolü:
- Kapasite ≥ arızalı disk (genelde aynı capacity)
- Medya: HDD / SSD / NVMe
- Arayüz: SAS / SATA / NVMe
- Form faktörü: 2.5 / 3.5 / E3.S
- Hız sınıfı: 10K/15K veya SSD endurance sınıfı
- Dell certified / aynı backplane uyumu
- BOSS/M.2 boot diskleri data RAID’inden ayrı tutulur
NVMe özel notlar: NVMe Kurulum. Controller diski görmüyorsa: RAID Controller Not Detecting Disks.
Ne Zaman Hot-Swap Yapılır?
Yapın (koşullar):
- Slot ve LED iki kez doğrulandı
- VD
Degradedveya Predictive için planlı pencere açıldı - Yedek disk eşleşmesi tamam
- Kritik iş yükü I/O’su mümkünse yumuşatıldı
- Hot spare yoksa manuel rebuild/assign planı hazır
Yapmayın:
- Slot belirsiz
- VD zaten
Offline - İkinci disk de Predictive/Failed gösteriyor ve tolerans bitti
- Disk Foreign Config taşıyor ve import/clear kararı net değil: Foreign State
- Yalnızca “sarı LED var” diye rastgele kızak çekmek
Hot-swap fiziksel adımlar: Disk Failure Hatası – Hot-Swap.
Predictive Failure (PDR16) Özel Yol
Predictive Failure, disk hâlâ Online iken gelir. Dell akışı özetle:
- Yedek alın
- SupportAssist + controller log alın
- Gerekirse HDD/SSD, iDRAC ve PERC firmware’ini güncelleyin (yanlış pozitif ihtimali)
- Hâlâ uyarı varsa diski değiştirin
- Mümkünse Replace Member / hot spare ile array’i Degraded’e düşürmeden kopyalama yapın
Firmware: Firmware Update Nasıl Yapılır.
Çoklu diskte PDR16: Dell Support’a gidin; peş peşe hot-swap risklidir.
Çoklu Disk veya Offline Virtual Disk
VD Offline olduğunda:
- Ek disk çekmeyin
- OS erişimini ve uygulama durumunu kaydedin
- Son yedek + RPO/RTO’yu netleştirin
- PERC log ve SupportAssist’i saklayın
- Foreign import / professional recovery kararını yalnız yazarak alın
- Gerekirse Boot Failure ve No Boot Device yollarını ayırın
Bu aşama “hızlı rebuild” değil; veri kurtarma disiplinidir.
Rebuild Sonrası Doğrulama
Yeni disk takıldıktan sonra bitiş kriterleri:
| Kontrol | Beklenen |
|---|---|
| Physical Disk | Online / Rebuild → Online |
| Virtual Disk | Optimal |
| Consistency / patrol | Planlandığı gibi |
| iDRAC alarm | Failed/Predictive temiz |
| Uygulama IOPS | Kabul edilebilir |
Rebuild çok yavaşsa: Disk Rebuild Çok Yavaş. Rebuild Rate yüksek tutulursa OS IOPS düşer; düşük tutulursa degraded pencere uzar.
Yaygın Hatalar
- Sağlam diski çekmek
- Predictive’i “çalışıyor” diye haftalarca bırakmak
- Kapasite/arayüz uyumsuz yedek takmak
- Offline VD’de deneme-yanılma hot-swap
- Rebuild bitmeden ikinci bakım yapmak
- RAID’i yedekleme sanmak
Kontrol Listesi
- Failed / Predictive / Degraded / Offline sınıflandırıldı.
- Slot + seri + kapasite + medya tipi yazılı.
- Virtual Disk durumu ekran görüntüsü alındı.
- Hot spare durumu kontrol edildi.
- Son yedek zamanı doğrulandı.
- SupportAssist / PERC log dışa aktarıldı.
- Yedek disk eşleşmesi tamam.
- Hot-swap veya Replace Member kararı yazılı.
- Rebuild başladı ve izleniyor.
- VD Optimal olduktan sonra alarm kapandı.
LeonX ile Sonraki Adım
LeonX, disk failure olaylarında Sunucu Bakım, Garanti ve Teknik Destek, Orijinal Donanım Bileşen Tedarik ve Uyumluluk Kontrolü ve Sunucu Kurulum, Konfigürasyon ve Devreye Alma ile doğru parça ve güvenli müdahaleyi birleştirir. Keşif için İletişime Geçin.
Sık Sorulan Sorular
Disk Failure alarmında ilk ne yapmalıyım?
Slotu ve Virtual Disk durumunu iDRAC’tan sabitleyin; yedekleme zamanını doğrulayın. Hot-swap, bu iki doğrulamadan sonradır.
Predictive Failure ile Failed aynı mıdır?
Hayır. Predictive (PDR16) yakında arıza riskidir; disk hâlâ Online olabilir. Failed, diskin RAID’den düştüğünü gösterir ve acil değişim ister.
Hot spare varken yine müdahale gerekir mi?
Evet. Hot spare rebuild’i başlatır ama arızalı diski fiziksel olarak değiştirmeniz, spare’i yeniden tanımlamanız ve VD’nin Optimal olduğunu doğrulamanız gerekir.
Offline Virtual Disk’te disk çekilir mi?
Hayır. Önce log, yedek ve recovery planı; rastgele hot-swap ikinci kayba yol açabilir.
Rebuild bitmeden sistem kullanılır mı?
Çoğu Degraded senaryoda evet, ama IOPS düşer ve ikinci arıza felakettir. Ağır batch işlerini erteleyin; bitişte VD Optimal olmalı.


