Comment vérifier si un bloc d’alimentation est défectueux

概要: Cet article explique comment vérifier si une panne de bloc d’alimentation Isilon est authentique ou non.

この記事は次に適用されます: この記事は次には適用されません: この記事は、特定の製品に関連付けられていません。 すべての製品パージョンがこの記事に記載されているわけではありません。

手順

Impact sur les opérations de données et de cluster

A "Loss in power supply redundancy detected" L’alerte signifie qu’un bloc d’alimentation (PSU) du nœud a cessé de fournir de l’alimentation. Le nœud continue de fonctionner sur son alimentation restante et les données ne sont pas en danger immédiat au moment de cette alerte.

OneFS utilise FlexProtect, un mécanisme de protection des données distribuée basé sur le codage d’effacement Reed-Solomon, qui peut supporter plusieurs défaillances simultanées de nœuds ou de disques (en fonction des niveaux de protection configurés). Même si le nœud concerné venait à être entièrement mis hors ligne, les données resteraient accessibles à partir des autres nœuds du cluster.

Toutefois, le nœud a perdu la redondance du bloc d’alimentation. Si le bloc d’alimentation restant tombe également en panne, le nœud passe hors ligne. Pour cette raison, traitez cette alerte comme urgente et effectuez rapidement les étapes de diagnostic et de remplacement ci-dessous.

Recommandation pour les grands clusters : assurez-vous que tous les nœuds conservent la redondance totale des blocs d’alimentation et que votre datacenter est équipé d’un onduleur et/ou d’un générateur sauvegardé par batterie. Pour plus d’informations, reportez-vous au livre blanc Dell PowerScale : considérations et pratiques d’excellence pour les grands clusters sur l’Info Hub Dell Technologies.

 
Pour vérifier si un bloc d’alimentation est réellement défectueux :
  1. Ouvrez une connexion SSH sur n’importe quel nœud du cluster et connectez-vous à l’aide du compte « root ». "root" Accounts
  2. Exécutez les commandes suivantes :
    1. Pour vérifier l’état du bloc d’alimentation sur un nœud :
      # isi_hw_status | grep -i -A2 "Power Supplies"
      
      Power Supplies OK
      Power Supply 1 good
      Power Supply 2 good
    2. Pour vérifier l’état du bloc d’alimentation sur un nœud :
      # isi_for_array -s isi_hw_status | grep -i -A2 "Power Supplies"
      
      RTPIsilon02-1: Power Supplies OK
      RTPIsilon02-1: Power Supply 1 good
      RTPIsilon02-1: Power Supply 2 good
      --
      RTPIsilon02-2: Power Supplies OK
      RTPIsilon02-2: Power Supply 1 good
      RTPIsilon02-2: Power Supply 2 good
    3. La sortie ci-dessus montre que tous les blocs d’alimentation sont OKAucune action n’est requise.
  3. Si tous les blocs d’alimentation sont OK, effacez les fausses alertes et surveillez le cluster pendant 24 heures.
    1. Pour effacer uniquement l’alerte d’alimentation spécifique, obtenez l’ID de groupe et utilisez la commande «isi event groups modify.
      # isi event groups list
      
      ID   Started     Ended       Causes Short                  Lnn  Events  Severity
      -----------------------------------------------------------------------------------
      3074 01/01 00:25 01/01 00:25 POWER Supply Failed           4    1      Critical
      
      # isi event groups modify --resolved=yes --ignore=yes --id=<Group ID from above command>
      
      Example:
      # isi event groups modify --resolved=yes --ignore=yes --id=3074
    2. Pour effacer toutes les anciennes alertes sur l’ensemble du cluster :
      1. Pour OneFS 7.x.x.x
        # isi events cancel all
        # isi events quiet all
      2. Pour OneFS 8.x.x.x
        # isi event bulk --ignore=true
        # isi event bulk --resolved=true
  4. En cas de défaillance d’un bloc d’alimentation dans la sortie de commande, contactez le support Isilon pour obtenir un remplacement.

Workflow consolidé : alerte de perte de redondance des blocs d’alimentation

Suivez ces étapes lorsque vous recevez un "Loss in power supply redundancy detected" ou alerte de bloc d’alimentation similaire :

Tableau 1. Alertes de perte de redondance

Étapes

ACTION

DOCUMENTATION

1

Vérifiez que l’alerte est réelle. Connectez-vous en SSH au cluster et vérifiez l’état du bloc d’alimentation sur le nœud concerné en suivant les étapes de la CLI ci-dessus. Si les blocs d’alimentation sont intègres, reportez-vous à l’article de la base de connaissances #517459 pour connaître le comportement des alertes erronées sur les nœuds Gen6.

Cet article 

KB #20717 

2

Identifiez le bon logement de bloc d’alimentation : pour les boîtiers de 6e génération (H500, H400, A200, A2000), utilisez le mappage bloc d’alimentation vers logement pour localiser le bon bloc d’alimentation physique. Mappage Gen6 : PS0 = Logement 1 / Logement 3 ; PS1 = Logement 2 / Logement 4.

KB #226947

3

Vérifiez le firmware du bloc d’alimentation : le firmware obsolète du bloc d’alimentation peut contribuer aux fausses alertes. Vérifiez la version du firmware via la CLI.

KB #19622

4

Contactez le support Dell : en cas de défaillance confirmée d’un bloc d’alimentation, ouvrez une demande de service auprès du support Dell Technologies pour remplacement. Collectez le numéro de série du nœud, le numéro de nœud et l’identifiant du logement du bloc d’alimentation avant d’appeler.

dell.com/support

 

その他の情報

Regardez cette vidéo :

対象製品

Isilon, PowerScale OneFS
文書のプロパティ
文書番号: 000020717
文書の種類: How To
最終更新: 27 7月 2026
バージョン:  7
質問に対する他のDellユーザーからの回答を見つける
サポート サービス
お使いのデバイスがサポート サービスの対象かどうかを確認してください。