PowerVault ME4, ME5: Zjišťování hostitelů, kteří ztrácejí přístup k poli
Shrnutí: Tento článek je určen správcům úložiště, kteří používají pole Dell PowerVault ME4/ME5. Vysvětluje, jak shromažďovat správné důkazy, provádět kontroly prvního průchodu a identifikovat běžné příčiny, když hostitelé ztratí přístup k namapovaným svazkům. Je-li vyžadována hlubší konfigurace hostitelského operačního systému nebo přepínače, nahlédněte po dokončení ověřovacích kroků na straně pole do dokumentace od dodavatele operačního systému nebo přepínače. ...
Pokyny
Účel a rozsah
Tento článek je určen správcům úložiště, kteří používají pole Dell PowerVault ME4/ME5. Vysvětluje, jak shromažďovat správné důkazy, provádět kontroly prvního průchodu a identifikovat běžné příčiny, když hostitelé ztratí přístup k namapovaným svazkům. Je-li vyžadována hlubší konfigurace hostitelského operačního systému nebo přepínače, nahlédněte po dokončení ověřovacích kroků na straně pole do dokumentace od dodavatele operačního systému nebo přepínače.
Přehled konektivity
- Rozhraní SAS (Serial Attached SCSI) je podporováno pouze jako přímo připojené úložiště (DAS ). Přepínače SAS nejsou v polích ME podporovány. Pro zajištění redundance použijte duální cesty k oběma řadičům.
- Rozhraní iSCSI (Internet Small Computer Systems Interface) a FC (Fibre Channel) podporují návrhy s přímým připojením a přepínačem. K zajištění odolnosti použijte dvě topologie Fabric nebo podsítě.
- Před provedením jakýchkoli změn ověřte hostitelské ovladače, firmware a transceivery.
1. Nejprve shromážděte správné důkazy.
Před provedením změn tyto informace shromážděte. Porovnejte vše s časovým rámcem a časovým pásmem incidentu.
Z pole (ME4/ME5)
- Vygenerujte balíček podpory v nástroji PowerVault Manager výběrem možnosti Maintenance, poté Support a Collect Logs. Balíček obsahuje události řadiče, úrovně firmwaru a stav frontendového portu.
- Kontrola výstrah a událostí v nástroji PowerVault Manager. Zaznamenejte všechny restartování řadiče, převzetí při selhání, resetování linky nebo událost skříně, která odpovídá incidentu.
Na co se zaměřit: stavy linky dolů, nesoulad rychlosti nebo vyjednávání, rostoucí čítače chyb nebo chybějící iniciátory ve srovnání s očekávaným návrhem.
Z hostitelů Windows Serveru
Zkontrolujte funkci MPIO a ujistěte se, že jsou zařízení deklarována a že je k dispozici očekávaný počet aktivních/optimalizovaných cest. Exportujte relevantní události disku, StorPortu a funkce MPIO (Multipath IO) z Prohlížeče událostí v souvislosti s incidentem. Porovnejte verze ovladače a firmwaru HBA (hostitelská sběrnice) a síťové karty s nejnovějšími dostupnými verzemi.
Od hostitelů VMware ESXi
Vyhledejte vmkernel.log události APD (všechny cesty dolů), PDL (trvalá ztráta zařízení) a přechod cesty.
Ověřte, že každé zařízení datového úložiště zobrazuje očekávaný počet cest a že je zásada vhodná pro pole ME, jako je například kruhové dotazování.
esxcli storage core path list
esxcli storage core device list
Z hostitelů se systémem Linux
Ověřte, že vícenásobná cesta zobrazuje více aktivních cest na WVID, a proveďte relaci chyb přenosu jádra s časem incidentu. Ověřte verzi ovladače a firmwaru HBA.dmesg -T | egrep -i 'scsi|sas|reset|error'
multipath -ll
Ze sítě nebo topologie Fabric (pokud se používá)
- Přepínače iSCSI: Zachyťte čítače CRC nebo drop pro jednotlivé porty, klapky spojení, nastavení MTU (maximální přenosová jednotka) a zásady řízení toku. Zajistěte, aby jednotka MTU byla při použití rámců typu jumbo konzistentní od začátku do konce, a povolte alespoň řízení toku příjmu na portech úložiště. Na hostitelských síťových kartách iSCSI použijte pro redundanci funkce MPIO namísto protokolu LACP.
- FC tkaniny: Shromážděte protokoly topologie Fabric pro FLOGI/PLOGI, RSCN a čítače chyb jednotlivých portů na obou topologiích. Ověřte, zda zónování odpovídá zamýšlenému návrhu.
2. Kontroly třídění, které vyřeší většinu případů.
-
Potvrďte zamýšlenou topologii. Pokud řadič používá SAS, zajistěte přímé připojení bez přepínače SAS a zachovejte duální cesty k oběma řadičům. V případě iSCSI a FC potvrďte rozložení se dvěma topy Fabric nebo dvěma podsítěmi.
-
Zkontrolujte události úložiště a stav portu. Srovnejte časová razítka událostí s chybami hostitele. Ověřte, zda jsou frontendové porty v provozu na očekávanou rychlost a zda jsou přihlášeny iniciátory. Prozkoumejte všechny porty s rostoucími čítači chyb.
-
Ověřte vícenásobné cesty hostitele.
- Windows Server s funkcí MPIO (Multipath I/O): Zařízení by měla být deklarována a měla by zobrazovat zamýšlený počet aktivních/optimalizovaných cest.
- VMware ESXi: Zařízení by měla zobrazovat úplný počet cest a odpovídající zásadu, například kruhové dotazování.
- Linux s mapovačem zařízení s více cestami: Každý vývoj mpath by měl zobrazovat několik aktivních cest.
- Zkontrolujte stabilitu přepravy.
- iSCSI: dvě izolované podsítě a sítě VLAN (virtuální místní sítě), konzistentní MTU a řízení příjmu nebo symetrického toku. Nahraďte agregaci linek funkcí MPIO pro datové cesty.
- FC: dvě topologie fabric a konzistentní zónování; Hledejte resetování spojení a selhání přihlášení.
- SAS: dvoucestná kabeláž k oběma řadičům bez přepínače v cestě; Zkontrolujte, zda v nástrojích HBA nedošlo k chybám PHY, a znovu zapojte nebo vyměňte podezřelé kabely.
- Potvrďte verzi softwaru a firmwaru. Porovnejte hostitelský adaptér HBA a ovladače a firmware síťové karty s maticí podpory a v případě potřeby proveďte aktualizaci.
3. Pokyny pro dopravu
SAS (přímo připojené)
- Použijte dvoucestný design DAS pro oba řadiče. Dodržujte podporované délky kabelů. Neumisťujte přepínač SAS do cesty k datům.
- V případě clusteringu Windows Serveru s adaptéry HBA SAS postupujte podle pokynů k operačnímu systému, pokud je zařízení identifikované jako pole RAID, nikoli jako HBA.
- Schémata a příklady kabeláže naleznete v příručce k nasazení.
iSCSI (přímo připojené nebo připojené k přepínači)
- Použijte dvě vyhrazené podsítě iSCSI a sítě VLAN s konzistentní výškou MTU a povolte příjem nebo symetrické řízení toku. V provedeních s přímým připojením připojte jednu kartu NIC pro každou podsíť k portu na odpovídajícím řadiči a použijte funkci MPIO.
- Pro systém VMware ESXi použijte softwarový iniciátor iSCSI. Offload karty iSCSI nejsou v ME5 podporovány. Použijte jedno VMkernel na topologii Fabric na přepínači vSwitch s jedním virtuálním uzlem.
Fibre Channel (DAS nebo SAN)
- Použijte dvě látky. Běžnou praxí je zónování s jedním iniciátorem a jedním cílem: Použijte jeden název WWPN (World Wide Port Name) hostitelského adaptéru HBA s jedním WWPN portu pole na zónu a opakujte jej na obou topologiích Fabric.
4. Běžné příčiny a jak je potvrdit.
- Převzetí při selhání nebo problém s firmwarem řadiče: Události pole ukazují restartování nebo převzetí služeb při selhání řadiče, které odpovídá APD nebo PDL hostitele v protokolech. Adresu firmwaru, pokud poznámky k verzi obsahují příslušné opravy.
- Chybná konfigurace více cest: Hostitelé vykazují snížený počet cest nebo hlásí mrtvé cesty. Opravte nastavení MPIO, NMP nebo Multipath a obnovte očekávanou cestu.
- Problémy se sítí iSCSI: Čítače přepínačů vykazují poklesy nebo chyby CRC nebo je jednotka MTU nekonzistentní. Povolte příjem nebo symetrické řízení toku, srovnejte MTU a nahraďte agregaci linky pomocí funkce MPIO.
- Zónování FC nebo nestabilita topologie Fabric: Dotčení hostitelé se nepřihlásí k jedné topologii Fabric nebo vykazují časté resetování linky. Správné zónování nebo oprava optiky a kabeláže.
- Degradace kabelu nebo portu SAS: Rostoucí počet chyb PHY nebo občasné stavy výpadku linky jsou viditelné v diagnostice pole nebo HBA. Znovu usaďte nebo vyměňte kabely.
- Nepodporované ovladače nebo firmware: Dotčeni jsou pouze určití hostitelé nebo adaptéry HBA. Tento problém vyřeší aktualizace na verze matice podpory.
5. Kontrolní seznam pro eskalaci
Při otevírání žádosti o službu zadejte následující položky:
- Balíček podpory pole a přesné okno incidentu s časovým pásmem
- Diagram topologie připojení hostitele, topologií Fabric a podsítí, včetně hostitelů, kteří ztratili přístup a které cesty byly ovlivněny.
- Důkaz hostitele:
- Windows Server: Zkontrolujte funkci MPIO a příslušné položky Prohlížeče událostí.
- VMware ESXi: Výňatky z vmkernel.log a výstup příkazů úložiště esxcli
- Linux: Výňatky z Dmesg a vícecestný výstup.
- Důkazy o přepínačích nebo topologii Fabric: čítače iSCSI a fragmenty konfigurace, protokoly FC Fabric a snímky obrazovky zónování.
- Inventář verzí: Firmware pole (v balíčku) a verze ovladače a firmwaru hostitelského adaptéru HBA nebo síťové karty.
6. Dokumentaci Dell k nahlédnutí naleznete na support.dell.com pod konkrétním modelem zařízení.
- Matice podpory: Podporované operační systémy, adaptéry HBA, síťové karty a pravidla
- Průvodce nasazením: Příklady kabeláže, počátečního nastavení a topologie.
- Příručka správce: Určeno pro každodenní správu.
- Reference k rozhraní příkazového řádku: Kompletní seznam příkazů show pro prozkoumání.