PowerFlex: impossibile cancellare gli errori del dispositivo SDS: lo stato del dispositivo è offline a livello di sistema operativo
Summary: L'utilizzo dell SDS "cancella errore dispositivo" non funziona e il dispositivo rimane in uno stato di errore o guasto. Quando sono presenti molti errori simultanei su un dispositivo SDS, un dispositivo potrebbe essere disconnesso dal sistema operativo che lo gestisce. ...
This article applies to
This article does not apply to
This article is not tied to any specific product.
Not all product versions are identified in this article.
Symptoms
Scenario
Il dispositivo SDS si guasta o segnala errori; quando si tenta di utilizzare "clear device error" dell SDS, il dispositivo rimane in uno stato di errore o errore.
Sintomi
Gli eventi di sistema ScaleIO segnalano errori o guasti del dispositivo disco:
799 2016-01-22 17:28:39.818 SDS_DEV_ERROR_REPORT ERROR Device error reported on SDS: 10.3.1.21, Device: /dev/sdb. State: NORMAL upDownState: UP processState: DEV_ERR_INPROGRESS devErrState: REPORT
Query SDS segnala errori o guasti del dispositivo disco:
ScaleIO-10-1-1-202:~ # scli --query_sds --sds_id 9780122600000003
Device information (total 8 devices):
1: Name: ScaleIO-6a0a6209 Path: /dev/sdb Original-path: /dev/sdb ID: 851f01c100030000
Storage Pool: SASPOOL, Capacity: 1675 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Normal
2: Name: ScaleIO-6a0a620a Path: /dev/sdc Original-path: /dev/sdc ID: 851f01c200030001
Storage Pool: SASPOOL, Capacity: 1675 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Normal
3: Name: ScaleIO-6a0a620b Path: /dev/sdd Original-path: /dev/sdd ID: 851f01c300030002
Storage Pool: SASPOOL, Capacity: 1675 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Normal
4: Name: ScaleIO-6a0a620c Path: /dev/sde Original-path: /dev/sde ID: 851f01c400030003
Storage Pool: SSDPOOL, Capacity: 1489 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Normal
5: Name: ScaleIO-6a0a620d Path: /dev/sdf Original-path: /dev/sdf ID: 851f01c500030004
Storage Pool: SASPOOL, Capacity: 1675 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Error
6: Name: ScaleIO-6a0a620e Path: /dev/sdg Original-path: /dev/sdg ID: 851f01c600030005
Storage Pool: SSDPOOL, Capacity: 1489 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Normal
7: Name: ScaleIO-6a0a620f Path: /dev/sdh Original-path: /dev/sdh ID: 851f01c700030006
Storage Pool: SASPOOL, Capacity: 1675 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Normal
8: Name: ScaleIO-6a0a6210 Path: /dev/sdi Original-path: /dev/sdi ID: 851f01c800030007
Storage Pool: SASPOOL, Capacity: 1675 GB Error-fixes: 0 scanned 0 MB, Compare errors: 0 State: Normal
Il file di messaggi SVM/Linux segnala un dispositivo offline:
Jan 22 17:28:35 ScaleIO-10-1-1-201 kernel: [45678.865605] end_request: I/O error, dev sdg, sector 1138313984 Jan 22 17:28:37 ScaleIO-10-1-1-201 kernel: [45681.452800] sd 2:0:6:0: [sdg] task abort on host 2, ffff8800b83f6e80 Jan 22 17:28:37 ScaleIO-10-1-1-201 kernel: [45681.452877] sd 2:0:1:0: [sdb] task abort on host 2, ffff8801b7476d80 Jan 22 17:28:37 ScaleIO-10-1-1-201 kernel: [45681.453086] sd 2:0:8:0: [sdh] task abort on host 2, ffff8800b83f6280 Jan 22 17:28:37 ScaleIO-10-1-1-201 kernel: [45681.453109] sd 2:0:8:0: [sdh] task abort on host 2, ffff8800a37a6c80 Jan 22 17:28:37 ScaleIO-10-1-1-201 kernel: [45681.453133] sd 2:0:9:0: [sdi] task abort on host 2, ffff8800b83f6b80 Jan 22 17:28:47 ScaleIO-10-1-1-201 kernel: [45691.537180] sd 2:0:5:0: rejecting I/O to offline device
Il registro VMkernel ESXi riporta errori sul dispositivo disco:
2016-01-22T09:40:21.801Z cpu1:33420)ScsiDeviceIO: 7024: Could not detect setting of QErr for device naa.614187704f3b47001e34b585468abf85. Error Not supported. 2016-01-22T09:40:21.801Z cpu1:33420)ScsiDeviceIO: 7538: Could not detect setting of sitpua for device naa.614187704f3b47001e34b585468abf85. Error Not supported. 2016-01-22T09:40:21.801Z cpu5:33593)NMP: nmp_ThrottleLogForDevice:3178: Cmd 0x28 (0x439e1a830cc0, 0) to dev "naa.614187704f3b47001e34b585468abf85" on path "vmhba1:C2:T1:L0" Failed: H:0x0 D:0x2 P:0x0 Valid sense data: 0x6 0x29 0x0. Act:NONE 2016-01-22T09:40:21.801Z cpu5:33593)ScsiDeviceIO: 2607: Cmd(0x439e1a830cc0) 0x28, CmdSN 0xd62 from world 0 to dev "naa.614187704f3b47001e34b585468abf85" failed H:0x0 D:0x2 P:0x0 Valid sense data: 0x6 0x29 0x0. 2016-01-22T09:40:21.801Z cpu5:33593)ScsiCore: 1609: Power-on Reset occurred on naa.614187704f3b47001e34b585468abf85 2016-01-22T09:40:21.844Z cpu5:33593)NMP: nmp_ThrottleLogForDevice:3178: Cmd 0x1a (0x439e1a830cc0, 0) to dev "naa.614187704f3b47001e34b585468abf85" on path "vmhba1:C2:T1:L0" Failed: H:0x0 D:0x2 P:0x0 Valid sense data: 0x5 0x24 0x0. Act:NONE 2016-01-22T09:40:21.844Z cpu5:33593)ScsiDeviceIO: 2645: Cmd(0x439e1a830cc0) 0x1a, CmdSN 0xd66 from world 0 to dev "naa.614187704f3b47001e34b585468abf85" failed H:0x0 D:0x2 P:0x0 Valid sense data: 0x5 0x24 0x0. 2016-01-22T09:40:21.844Z cpu1:33420)ScsiDevice: 3835: Successfully registered device "naa.614187704f3b47001e34b585468abf85" from plugin "NMP" of type 0 2016-01-22T09:40:21.844Z cpu1:33420)NMP: nmp_DeviceUpdateProtectionInfo:569: Set protection info for device 'naa.614187704f3b47001e34b585468abf85', Enabled: 0 ProtType: 0x0 Guard: 0x0 ProtMask: 0x0 2016-01-22T22:27:49.085Z cpu19:33115)WARNING: NMP: nmpDeviceTaskMgmt:2284: Attempt to issue lun reset on device naa.614187704f3b47001e34b585468abf85. This will clear any SCSI-2 reservations on the device.
Impatto
Il dispositivo disco rimane guasto.
Non è possibile cancellare gli errori del dispositivo SDS.
Cause
Se si verifica un problema con il dispositivo disco e il dispositivo disco non risponde per qualsiasi motivo, il sistema operativo disconnette il dispositivo disco.
Nota: Se il dispositivo disco non funziona correttamente, il dispositivo non torna allo stato online e potrebbe essere necessario sostituirlo.
Resolution
Soluzione alternativa
SVM - Ambiente Linux:
- Verificare lo stato corrente del dispositivo disco:
[root@ssltest ~]# cat /sys/block/sdx/device/state offline
- Se il dispositivo disco è contrassegnato come "offline", utilizzare il seguente comando per rendere "online" il dispositivo disco:
echo "running" > /sys/block/sdx/device/state
- Utilizzando la SCLI o l'interfaccia utente, cancellare l'errore del dispositivo SDS .
Ambiente Windows:
- Verificare lo stato corrente del dispositivo disco utilizzando "Logical Disk Manager" o Disk Part:
C:\>diskpart Microsoft DiskPart version 6.1.7601 Copyright (C) 1999-2008 Microsoft Corporation. On computer: ISENABLOVSL1C DISKPART> list disk Disk ### Status Size Free Dyn Gpt -------- ------------- ------- ------- --- --- Disk 0 Online 238 GB 0 B DISKPART>
- Se il dispositivo disco è contrassegnato come "offline", utilizzare il seguente comando per rendere "online" il dispositivo disco o utilizzare "Logical Disk Manager":
DISKPART> online disk
Un'opzione alternativa al dispositivo disco online su qualsiasi sistema operativo:
Nota: Questa opzione richiede "downtime" e attiva la ricostruzione/il ribilanciamento sul sistema ScaleIO:
- Se possibile, portare l SDS in modalità di manutenzione
- Riavviare l SDS Server
- Uscire dalla modalità di manutenzione (se eseguita nel passaggio 1)
- Cancellazione dell'errore del dispositivo SDS (tramite interfaccia utente o CLI)
- Verifica dello stato del dispositivo in ScaleIO
Affected Products
PowerFlex rack, ScaleIOArticle Properties
Article Number: 000281632
Article Type: Solution
Last Modified: 06 Mar 2025
Version: 3
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.