PowerFlex: Gerät hat behobene Lesefehler – Zähler für Gerätefehler zurücksetzen
Summary: SDS-Geräte weisen Fehler auf, die Folgendes enthalten: "Gerät hat Lesefehler behoben".
Symptoms
- Dieses Problem tritt auf, wenn auf einem SDS-Gerät Lesefehler vorliegen, die vom SDS behoben werden.
- Dies tritt auf, wenn der Hintergrundscanner deaktiviert oder aktiviert ist.
Die behobenen Fehler auf einem Gerät werden an den folgenden Stellen angezeigt:
-
Die GUI zeigt einen Fehler an:

-
Das "
--query_sds --sds_id <SDS_ID>" Die Ausgabe zeigt einen Zähler für jedes Gerät mit korrigierten Lesefehlern an:
15: Name: /dev/sdr Path: /dev/sdr Original-path: /dev/sdr ID: 2d63f7c80003000e
Storage Pool: SAS_pool1, Capacity: 1116 GB Error-fixes: 6 scanned 0 MB, Compare errors: 0 State: Normal
Die Tasten counters_dump.txt in MDM getInfoDump zeigt die FIXED_READ_ERROR_COUNT Auf verschiedenen Objekten:
ID: df7700a600120012 DEVICE_TYPE READ_ERR FIXED_READ_ERROR_COUNT 1 ID: 1d1e4e5500000012 SDS_TYPE READ_ERR FIXED_READ_ERROR_COUNT 1 ID: 1c34e1f700000007 STORAGE_POOL_TYPE READ_ERR FIXED_READ_ERROR_COUNT 1 ID: b9b286df00000001 PROTECTION_DOMAIN_TYPE READ_ERR FIXED_READ_ERROR_COUNT 1 ID: 49b6b8057d1fc84b SYSTEM_TYPE READ_ERR FIXED_READ_ERROR_COUNT 1
Weitere mögliche Symptome: Das Gerät befindet sich möglicherweise in einem Fehlerzustand. Möglicherweise liegen Fehler auf dem Blockgerät in den Systemmeldungen oder im Syslog vor:
blk_update_request: critical medium error, dev sdr, sector 94390272 sd 0:2:15:0: [sdr] tag#1 FAILED Result: hostbyte=DID_OK driverbyte=DRIVER_SENSE sd 0:2:15:0: [sdr] tag#1 Sense Key : Medium Error [current] sd 0:2:15:0: [sdr] tag#1 Add. Sense: Unrecovered read error
In der SDS-Ablaufverfolgung sind möglicherweise lange Inflight-I/O-Meldungen vorhanden:
contDevMngr_HandleLongInflightIoViolation:02998: IO on devId: 2d63f7c80003000e (/dev/sdr) took too long, Low threshold exceeded - waited for reaper 12250 millis contDevMngr_HandleLongInflightIoViolation:02998: IO on devId: 2d63f7c80003000e (/dev/sdr) took too long, Low threshold exceeded - waited for reaper 13250 millis contDevMngr_HandleLongInflightIoViolation:02998: IO on devId: 2d63f7c80003000e (/dev/sdr) took too long, Low threshold exceeded - waited for reaper 14250 millis
Möglicherweise liegen Fehler in den I/O-Zählern des Geräts in SDS vor. sdbg_out.txt:
13: Dev path:/dev/sdr Size(lbs):0 Time grn:520577464
Io Counters:
GENERAL
Writes: 4852 Lbs: 2160443 MBs: 1054 Errors: 0
Reads: 49283 Lbs: 111376 MBs: 54 Errors: 12744
BM
Writes: 0 Lbs: 0 MBs: 0 Errors: 0
Reads: 0 Lbs: 0 MBs: 0 Errors: 0
COMB_MAP
Writes: 5 Lbs: 1390 MBs: 0 Errors: 2
Reads: 0 Lbs: 0 MBs: 0 Errors: 0
TOOTH_MAP
Writes: 426 Lbs: 688528 MBs: 336 Errors: 424
Reads: 0 Lbs: 0 MBs: 0 Errors: 0
IO
Writes: 4319 Lbs: 603064 MBs: 294 Errors: 16
Reads: 2076 Lbs: 16608 MBs: 8 Errors: 22
Die Latenz des Geräts kann je nach counters_dump.txt:
ID: 2d63f7c60003000c DEVICE_TYPE DEV_LATENCY AVG_WRITE_LATENCY_IN_MICROSEC 0 ID: 2d63f7c70003000d DEVICE_TYPE DEV_LATENCY AVG_WRITE_LATENCY_IN_MICROSEC 0 ID: 2d63f7c80003000e DEVICE_TYPE DEV_LATENCY AVG_WRITE_LATENCY_IN_MICROSEC 11424 ID: 2d63f7c90003000f DEVICE_TYPE DEV_LATENCY AVG_WRITE_LATENCY_IN_MICROSEC 0 ID: 2d63f7ca00030010 DEVICE_TYPE DEV_LATENCY AVG_WRITE_LATENCY_IN_MICROSEC 0
Auswirkungen
Der Zähler "Fixed Read Errors" hat keine direkten Auswirkungen auf das System.
Es kann jedoch auf eine zugrunde liegende Bedingung hinweisen, die zu SDS-Trennungen, Neuerstellungsaktivitäten usw. führen kann.
Cause
Dieses Problem tritt auf, wenn auf einem SDS-Gerät Lesefehler auftraten, die mithilfe der gespiegelten Kopie behoben oder behoben wurden. Die Korrektur erfolgt in den folgenden Fällen:
- Der Hintergrundscanner liest nicht aus einer Kopie der Daten und verwendet die andere Kopie, um sie zu überschreiben.
- Ein SDS kann die Leseanforderungen eines SDC aufgrund eines Fehlers beim Lesen der Festplatte nicht bedienen und verwendet die sekundäre Kopie, um den I/O zu bedienen und die lokalen Daten zu überschreiben.
Die Warnung weist darauf hin, dass das Laufwerk möglicherweise langsamer wird, fehlerhaft wird oder fehlerhafte Blöcke aufweist. Die oben beschriebenen Mechanismen schreiben die Blöcke neu, wodurch "weiche" fehlerhafte Blöcke repariert werden können.
Resolution
- Überprüfen Sie die Festplatte. Wenden Sie sich bei Bedarf an den Hardwareanbieter, um sie auszutauschen. Der Zähler weist in der Regel auf eine zugrunde liegende Bedingung hin und die Festplatte bricht ab. Die oben erläuterte Aktion des SDS ist ein Versuch, weiche fehlerhafte Blöcke zu reparieren, ist jedoch möglicherweise nicht in allen Szenarien erfolgreich.
- Löschen Sie den Fehlerzähler, indem Sie den folgenden Befehl über den primären MDM mit Administratoranmeldung ausführen
scli --reset_scanner_error_counters --protection_domain_id <pd id> --storage_pool_id <sp id> --reset_corrected_read_error_counter
Sie können das Dienstprogramm scli --query_all -Befehl zum Auflisten der Schutzdomain- und Storage-Pool-IDs.