PowerVault ME4, ME5: Undersøgelse af værter, der mister adgang til system
Oversigt: Denne artikel henvender sig til storageadministratorer, der bruger Dell PowerVault ME4/ME5-systemer. Den forklarer, hvordan du indsamler de rigtige beviser, udfører førstegangskontrol og identificerer almindelige årsager, når værter mister adgang til kortlagte diskenheder. Hvis der kræves en dybere konfiguration af værtsoperativsystemet eller -switchen, skal du se dokumentationen fra producenten af operativsystemet eller switchen, når du har fuldført valideringstrinnene på systemsiden. ...
Instruktioner
Formål og anvendelsesområde
Denne artikel henvender sig til storageadministratorer, der bruger Dell PowerVault ME4/ME5-systemer. Den forklarer, hvordan du indsamler de rigtige beviser, udfører førstegangskontrol og identificerer almindelige årsager, når værter mister adgang til kortlagte diskenheder. Hvis der kræves en dybere konfiguration af værtsoperativsystemet eller -switchen, skal du se dokumentationen fra producenten af operativsystemet eller switchen, når du har fuldført valideringstrinnene på systemsiden.
Oversigt over tilslutningsmuligheder
- SAS (Serial Attached SCSI) understøttes kun som DAS (Direct Attached Storage ). SAS-switche understøttes ikke med ME-systemer. Brug to stier til begge controllere for redundans.
- Internet Small Computer Systems Interface (iSCSI) og Fibre Channel (FC) understøtter design designet med direkte tilslutning og switchtilslutning. Brug to strukturer eller undernet for at opnå elasticitet.
- Valider værtsdrivere, firmware og transceivere, før du foretager ændringer.
1. Indsaml først de rigtige beviser.
Indsaml disse oplysninger, før du foretager ændringer. Korreler alt til hændelsens tidsramme og tidszone.
Fra systemet (ME4/ME5)
- Generer supportpakken i PowerVault Manager ved at vælge Vedligeholdelse, derefter Support og derefter Indsaml logfiler. Pakken indeholder controllerhændelser, firmwareniveauer og status for frontend-port.
- Gennemse advarsler og hændelser i PowerVault Manager. Registrer enhver genstart, failover, linknulstilling eller kabinethændelse, der passer til hændelsen.
Det skal man kigge efter: link-down-tilstande, uoverensstemmelser mellem hastighed eller forhandling, stigende fejltællere eller manglende initiatorer sammenlignet med det forventede design.
Fra Windows Server-værter
Kontroller MPIO, og bekræft, at der er gjort krav på enheder, og at det forventede antal aktive/optimerede stier er til stede. Eksporter relevante Disk-, StorPort- og Multipath IO-hændelser (MPIO) fra Logbog omkring hændelsen. Sammenlign driver- og firmwareversioner til HBA (host bus-adapter) og netværkskort med de nyeste tilgængelige versioner.
Fra VMware ESXi-værter
Søg i vmkernel.log efter APD (alle stier ned), PDL (permanent enhedstab) og stiovergangshændelser.
Bekræft, at hver datalagerenhed viser det forventede antal stier, og at politikken er relevant for ME-systemer, f.eks. Round Robin.
esxcli storage core path list
esxcli storage core device list
Fra Linux-værter
Bekræft, at multipath viser flere aktive stier pr. WWID, og korreler kernetransportfejl til hændelsestidspunktet. Valider HBA-driver- og firmwareversioner.dmesg -T | egrep -i 'scsi|sas|reset|error'
multipath -ll
Fra netværket eller strukturen (hvis brugt)
- iSCSI-switche: Optag CRC- eller faldtællere pr. port, linkflapper, MTU-indstillinger (maksimal transmissionsenhed) og flowkontrolpolitik. Sørg for, at MTU er konsistent fra start til slut, når du bruger jumborammer, og aktiver som minimum modtageflowkontrol på lagerporte. Brug MPIO til redundans i stedet for LACP på værts-iSCSI-netværkskort.
- FC stoffer: Indsaml strukturlogfiler til FLOGI/PLOGI, RSCN er og fejltællere pr. port på begge strukturer. Kontrollér, at zoneinddelingen svarer til det tilsigtede design.
2. Triage-kontroller, der løser de fleste sager.
-
Bekræft den ønskede topologi. Hvis controlleren bruger SAS, skal du sikre et design med direkte tilslutning uden en SAS-switch og bevare to stier til begge controllere. For iSCSI og FC skal du bekræfte et layout med to eller to undernet.
-
Gennemgå lagringshændelserne og porttilstanden. Juster hændelsestidsstempler med værtsfejl. Kontroller, at frontend-porte er oppe med den forventede hastighed, og at initiatorer er logget på. Undersøg alle porte med stigende fejltællere.
-
Valider værtsmultipathing.
- Windows Server med Multipath I/O (MPIO): Der skal gøres krav på enheder, som viser det tilsigtede antal aktive/optimerede stier.
- VMware ESXi: Enheder skal vise et fuldt antal stier og en passende politik, f.eks. Round Robin.
- Linux med device-mapper multipath: Hver mpath-udvikler skal vise flere aktive stier.
- Kontroller transportstabiliteten.
- iSCSI: to isolerede undernet og VLAN er (virtuelle lokale netværk), konsistent MTU og modtage- eller symmetrisk flowkontrol. Erstat linksammenlægning med MPIO for datastier.
- FC: to stoffer og konsekvent zoneinddeling; Se efter linknulstillinger og loginfejl.
- SAS: kabelføring med to stier til begge controllere og ingen kontakt i stien; kontrollere HBA-værktøjer for PHY-fejl og genindsætte eller udskifte mistænkelige kabler.
- Bekræfte software- og firmwareversioner. Sammenlign værts-HBA- og netværkskortdrivere og firmware med supportmatrixen, og opdater om nødvendigt.
3. Transportspecifik vejledning
SAS (direkte tilsluttet)
- Brug et DAS-design med to stier til begge controllere. Hold dig inden for understøttede kabellængder. Anbring ikke en SAS-switch i datastien.
- For Windows Server-klynger med SAS HBA er skal du følge operativsystemets vejledning, hvis en enhed identificeres som RAID i stedet for en HBA.
- Se implementeringsvejledningen for at få oplysninger om diagrammer og eksempler på kabelføring.
iSCSI (direkte tilsluttet eller switch-tilsluttet)
- Brug to dedikerede iSCSI-undernet og VLAN er med ensartet MTU, og aktiver modtage- eller symmetrisk flowstyring. Ved design med direkte tilslutning skal du slutte ét netværkskort pr. undernet til en port på den tilsvarende controller og bruge MPIO.
- Til VMware ESXi skal du bruge iSCSI-softwareinitiatoren. iSCSI-aflastningskort understøttes ikke med ME5. Brug én VMkernel pr. fabric på en vSwitch med en enkelt vmnic.
Fibre Channel (DAS eller SAN)
- Brug to stoffer. En almindelig praksis er single-initiator, single-target zoneinddeling: Brug én værts-HBA WWPN (World Wide Port Name) med ét WWPN-system pr. zone og gentaget på begge strukturer.
4. Almindelige årsager og hvordan man bekræfter dem.
- Controller-failover eller firmwareproblem: Systemhændelser viser en genstart eller failover af controlleren, der passer med værtens APD eller PDL i logfiler. Adresser firmware, hvis produktbemærkninger angiver relevante rettelser.
- Multipathing fejlkonfiguration: Værter viser et reduceret antal stier eller rapporterer døde stier. Korrekte MPIO-, NMP- eller multipath-indstillinger for at gendanne forventet pathing.
- Problemer med iSCSI-netværk: Switchtællere viser fald eller CRC-fejl, eller MTU er inkonsekvent. Aktivér modtage- eller symmetrisk flowkontrol, juster MTU, og erstat linksammenlægning med MPIO.
- FC-zoneinddeling eller ustabil struktur: Berørte værter kan ikke logge på én struktur eller vise hyppige nulstillinger af links. Korrekt zoneinddeling eller afhjælpning af optik og kabler.
- Beskadigelse af SAS-kabel eller -port: Stigende PHY-fejl eller intermitterende link down-tilstande er synlige i array- eller HBA-diagnostik; Nulstil eller udskift kabler.
- Ikke-understøttede drivere eller firmware: Kun visse værter eller HBA'er påvirkes. Opdatering til Support Matrix-versioner løser tilstanden.
5. Tjekliste til eskalering
Angiv følgende elementer, når du åbner en serviceanmodning:
- Systemets supportpakke og det præcise hændelsesvindue med tidszone
- Et topologidiagram over værtsforbindelser og strukturer og undernet, herunder hvilke værter der mistede adgangen, og hvilke stier der blev påvirket.
- Værtsbevis:
- Windows Server: Kontroller MPIO og relevante Event Viewer-poster.
- VMware ESXi: Uddrag fra vmkernel.log og output af esxcli-lagerkommandoer
- Linux: DMESG-uddrag og multipath-output.
- Switch- eller strukturbeviser: iSCSI-tællere og konfigurationsuddrag samt FC-strukturlogfiler og skærmbilleder af zoneinddeling.
- Version lager: Systemets firmware (i pakken) og værts-HBA- eller NIC-driver og firmwareversioner.
6. Dells dokumentation, der skal konsulteres, kan findes på support.dell.com under den specifikke enhedsmodel
- Supportmatrix: Understøttede operativsystemer, HBA er, netværkskort og regler
- Implementeringsvejledninger: Eksempler på kabelføring, indledende opsætning og topologi.
- Administratorvejledning: Dette er til den daglige ledelse.
- CLI-reference: Komplet liste over showkommandoer til undersøgelse.