Data Domain: disco guasto, assente, sconosciuto o spento

摘要: Questo articolo descrive come risolvere la condizione in cui un'unità disco si trova in uno stato di errore, assenza o spegnimento.

本文适用于 本文不适用于 本文并非针对某种特定的产品。 本文并非包含所有产品版本。

症状

Avviso | Codice sintomo:

  • Codici evento: STORAGE-00001, STORAGE-00002, PHYM-00001
  • Messaggi di avviso:
    • Enclosure disk has failed and should be replaced
    • Disk has a hardware fault and may need to be replaced
    • Disk is absent and should be replaced
    • Unable to access the disk; disk state is powered off
    • A disk has failed, and the enclosure slot has been disabled

Prodotti interessati:

  • Tutti i sistemi Data Domain
  • Tutte le versioni del software Data Domain Operating System (DDOS)

原因

DDOS monitora continuamente lo stato del disco e guasta automaticamente un'unità quando si verificano errori I/O critici.

Gli avvisi vengono generati quando un disco è:

  • Rimosso (assente)
  • Guasto o guasto
  • Spegnimento (manuale o automatico da DDOS per evitare problemi di back-end)

解决方案

  1. Verificare e confermare l'errore:
  • Verificare gli avvisi sul sistema utilizzando DDMC, l'interfaccia utente web di Data Domain System Manager (DDSM) o DD-CLI (SSH).
    • DD-CLI # alerts show current
    • DDSM > Alerts 
  • Identificare e confermare lo stato corrente di tutte le unità nel sistema.
    • DD-CLI # disk show state | AND | # disk show hardware
    • DDSMHardware > Archiviazione > Dischi 
      • Indicatori di stato del disco:

        • F = Guasto
        • R = Ricostruzione
        • S = Riserva
        • A = Assente
        • P = Spento

Esempio: DD-CLI:
# disk show state

sysadmin@DD# disk show state
Enclosure   Disk
             1  2  3  4  5  6  7  8  9  10 11 12 13 14 15
---------   ----------------------------------------------
1            .  .  .
2            .  .  .  .  .  .  .  .  .  .  .  .  .  .  s
3            .  .  .  .  .  .  .  .  .  .  .  .  .  .  s
4            .  .  .  .  .  F  .  .  .  .  .  .  .  .  R
---------   ----------------------------------------------

Qui si noti che il disco 4.6 (F)ailed - (R)ebuilding al disco di riserva 4.15.

Per i problemi relativi al disco DD3300, prendere in considerazione questo articolo Data Domain: DD3300 Mapping degli avvisi del disco allo slot del disco rigido corretto


  1. Inviare una Service Request (SR)
  • Sostituire i singoli dischi guasti il prima possibile.
  • Se una SR non è stata generata automaticamente tramite dial home:
    • Contattare il provider di supporto e inviare una SR.
  • Se sono presenti più guasti dei dischi:
    • Contattare immediatamente Dell ProSupport (o il fornitore di servizi con contratto) per ricevere istruzioni.

  1. Monitorare il sistema in attesa della sostituzione del disco.

Dopo aver generato una SR, continuare il monitoraggio per garantire la stabilità del sistema.

3.1 Comprendere perché i backup continuano.

    • I sistemi Data Domain utilizzano RAID 6 (doppia parità).
    • Il sistema protegge i dati in caso di guasto del disco.
    • DDOS ricostruisce automaticamente i dati su uno spare disponibile.
    • Le operazioni di backup e ripristino continuano durante la ricostruzione.

3.2 Verifica dello stato della ricostruzione.

    • eseguire:
      disk show state
      
    • Verificare che un disco mostri (R)econstructing.

3.3 Monitorare l'avanzamento della ricostruzione

    • Esegui di nuovo disk show state Periodicamente.
    • Il tempo di ricostruzione dipende dalle dimensioni del disco e dal carico del sistema.

3.4 Verificare la presenza di ulteriori guasti del disco.

    • ⚠️ Avviso
      criticoRAID 6 tollera due guasti del disco per gruppo di dischi.
      Un secondo guasto durante la ricostruzione aumenta il rischio.

    • Se si verifica un altro guasto del disco:

      • Contattare immediatamente Dell ProSupport (o il fornitore di servizi con contratto).

3.5 Identificare il disco fisico

    • Formato del disco: Enclosure.Slot (esempio: 2.27)
    • In DDSM:
      • Passare a Hardware > Storage > Disks
      • Selezionare il disco → cliccare su Beacon per abilitare il LED
    • In DD-CLI:
      • disk beacon n.n

3.6 Non rimuovere il disco guasto.

    • Lasciare installato il disco guasto fino all'arrivo del disco sostitutivo.
    • La rimozione anticipata non fornisce alcun vantaggio e può complicare il monitoraggio.

  1. Sostituire il disco guasto:
  • Seguire le procedure ufficiali di sostituzione del disco riportate nella documentazione di Data Domain.
    • Best Practice:

      • Attendere 2 minuti tra la rimozione e l'inserimento:

        1. Rimozione del disco guasto
        2. Attendere 2 minuti
        3. Inserire il disco sostitutivo
      • Ciò consente al controller di annullare correttamente la registrazione del disco precedente e impedisce problemi di riconoscimento hot-plug.


  1. Verifica dello stato post-sostituzione:

Da DD-CLI # disk show state

    • DDSM Hardware > Archiviazione > Dischi 

Esempio: DD-CLI:

    • sysadmin@DD# disk show state
      Enclosure   Disk
                   1  2  3  4  5  6  7  8  9  10 11 12 13 14 15
      ---------   ----------------------------------------------
      1            .  .  .
      2            .  .  .  .  .  .  .  .  .  .  .  .  .  .  s
      3            .  .  .  .  .  .  .  .  .  .  .  .  .  .  s
      4            .  .  .  .  .  s  .  .  .  .  .  .  .  .  .
      ---------   ----------------------------------------------
  • Il disco sostitutivo diventa di riserva e il disco ricostruito torna all'uso attivo.

  1. Risoluzione dei problemi relativi alla sostituzione.

Se il nuovo disco viene visualizzato come Unknown:

    1. Eseguire un comando. # disk rescan
    2. Verifica dello stato del disco da DD-CLI # disk show state

Se il nuovo disco viene segnalato come guasto

    1. Eseguire un comando. # disk rescan
    2. Verificare lo stato dell'unità da DD-CLI # disk show state
    3. Se il problema è ancora (F)danneggiato, eseguire questo comando da DD-CLI: # disk unfail <encl.disc>

Ad esempio: # disk unfail 5.6

Se lo stato del disco è confermato OK (In-use o Spare), cancellare tutti gli avvisi correlati:

    1. Da DD-CLI # alerts clear alert-id <alert-id>

    其他信息

    Riferimento:

    Guasti di più dischi?
    Se si sono verificati tre o più guasti del disco in un breve periodo di tempo (da giorni a
    settimane), ciò potrebbe indicare un problema sistemico (ad esempio, bug del multipathing o del firmware) piuttosto che errori di singoli dischi.

    Questa operazione potrebbe richiedere ulteriori indagini, generare un pacchetto di supporto e contattare il supporto

    受影响的产品

    Data Domain
    文章属性
    文章编号: 000043773
    文章类型: Solution
    上次修改时间: 07 7月 2026
    版本:  18
    从其他戴尔用户那里查找问题的答案
    支持服务
    检查您的设备是否在支持服务涵盖的范围内。