PowerFlex: Při ukončení PMM došlo k latenci velkého objemu
Summary: Ukončení režimu chráněné údržby (PMM) může mít za následek dočasně zvýšenou latenci svazku.
Symptoms
- Používají se sady chyb a více SDS opouští PMM současně.
Protokoly ESXi zobrazující latenci vůči svazku PowerFlex:
2025-03-26T19:20:58.764Z Wa(180) vmkwarning: cpu33:2098795)WARNING: ScsiDeviceIO: 1772: Device eui.##### performance has deteriorated. I/O latency increased from average value of 350 microseconds to 28802 microseconds.
Protokoly trasování SDS zobrazující migraci PMM pro příklad hřebene – dokončení interní migrace pro hřeben 746b009a00b6 trvá přibližně 27 milisekund.
2025/03/26 14:20:58.730516 MED:7f19cf3cedb0:contCmd_EndMigration:06164: CombId 746b009a00b6 - Start rc = SUCCESS
2025/03/26 14:20:58.730757 MED:7f19cf3cedb0:raidComb_EndExitPmmInter:02999: Comb 746b009a00b6: PMM becomes Rebuild (PMM remote 41a8b5e300000023), (Old rebuild remote 41a8b5df00000012).
2025/03/26 14:20:58.757184 MED:7f19cf3cedb0:contCmd_EndMigration:06197: CombId 746b009a00b6 - Done rc = SUCCESS
Důsledky
Dočasná latence svazku pozorovaná klienty SDC při ukončování PMM
Cause
Během výstupu z PMM jsou hřebeny nečinné, což zabraňuje operacím I/O. Latence je primárně zavedena v závěrečné fázi funkce raidComb_EndExitPmmInter, kdy systém posiluje bitmapy.
I když je tato operace obvykle rychlá, v tomto případě je zpoždění výraznější kvůli velkému počtu zapojených hřebenů, což je pravděpodobně způsobeno úplným setem chyb, který současně opouští PMM. To zvyšuje pravděpodobnost, že se ve fázi kalení setkáte s více hřebeny, což zesiluje dopad na latenci pozorovaný klienty SDC.
Resolution
Možná řešení, jak tomuto problému zabránit:
- Použijte režim okamžité údržby (IMM).
- Ukončete PMM vždy pouze na jednom SDS.
Dotčené verze
PowerFlex 3.x
PowerFlex 4.x
Opraveno ve verzi
PowerFlex 4.5.5