PowerFlex: Wystąpiło duże opóźnienie woluminu podczas opuszczania PMM
Summary: Wyjście z trybu chronionej konserwacji (PMM) może spowodować tymczasowe zwiększenie opóźnienia woluminu.
Symptoms
- Zestawy błędów są w użyciu, a wiele SDS opuszcza PMM w tym samym czasie.
Dzienniki ESXi wyświetlające opóźnienie względem woluminu PowerFlex:
2025-03-26T19:20:58.764Z Wa(180) vmkwarning: cpu33:2098795)WARNING: ScsiDeviceIO: 1772: Device eui.##### performance has deteriorated. I/O latency increased from average value of 350 microseconds to 28802 microseconds.
Dzienniki śledzenia SDS pokazujące migrację PMM dla przykładowego comba — ukończenie migracji wewnętrznej dla comb 746b009a00b6 zajmuje około 27 milisekund.
2025/03/26 14:20:58.730516 MED:7f19cf3cedb0:contCmd_EndMigration:06164: CombId 746b009a00b6 - Start rc = SUCCESS
2025/03/26 14:20:58.730757 MED:7f19cf3cedb0:raidComb_EndExitPmmInter:02999: Comb 746b009a00b6: PMM becomes Rebuild (PMM remote 41a8b5e300000023), (Old rebuild remote 41a8b5df00000012).
2025/03/26 14:20:58.757184 MED:7f19cf3cedb0:contCmd_EndMigration:06197: CombId 746b009a00b6 - Done rc = SUCCESS
Wpływ
Tymczasowe opóźnienie woluminu obserwowane przez klientów SDC podczas wychodzenia z PMM
Cause
Podczas wychodzenia z PMM grzebienie są w stanie spoczynku, co uniemożliwia operacje we/wy. Opóźnienie jest wprowadzane przede wszystkim w końcowej fazie funkcji raidComb_EndExitPmmInter, gdzie system wzmacnia bitmapy.
Chociaż ta operacja jest zazwyczaj szybka, w tym przypadku opóźnienie jest bardziej wyraźne ze względu na dużą liczbę grzebieni, prawdopodobnie spowodowaną jednoczesnym wyjściem pełnego zestawu usterek z PMM. Zwiększa to prawdopodobieństwo napotkania wielu combów na etapie wzmacniania, zwiększając wpływ na opóźnienia obserwowane przez klientów SDC.
Resolution
Możliwe rozwiązania tego problemu:
- Użyj trybu natychmiastowej konserwacji (IMM).
- Zamknij PMM tylko na jednym serwerze SDS naraz.
Wersje, których dotyczy problem
PowerFlex 3.x
PowerFlex 4.x
Naprawiono w wersji
PowerFlex 4.5.5