PowerScale: SyncIQ 관계의 한 클러스터가 다른 클러스터보다 사용된 디스크 공간을 더 많이 보고합니다.
Сводка: 이 문서에서는 syncIQ 관계의 한 클러스터(소스 또는 타겟)가 다른 클러스터보다 사용된 디스크 공간을 더 많이 보고할 수 있는 이유에 대해 설명합니다. 두 클러스터 모두 동일하게 사용된 디스크 공간을 표시해야 합니다. SyncIQ 작업이 최신 상태입니다.
Симптомы
syncIQ 관계(소스 또는 타겟)에 있는 하나의 PowerScale 클러스터에 다른 PowerScale 클러스터보다 사용된 디스크 공간이 더 많습니다. 두 클러스터의 사용 공간이 동일해야 합니다.
예를 들어, 'isi status' 명령:
타겟 클러스터는 349T가 하드 드라이브(HDD) 스토리지를 사용함을 보여줍니다.
Cluster Name: TARGET-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.73 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 348.6T (84%) 669.1G (11%) ==================> Avail: 68.6T (16%) 5.1T (89%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|1099.2.6 | OK | 1.0M| 488k| 1.5M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 10|10.99.2.7 | OK | 820M| 4.2M| 824M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 11|10.99.2.8 | OK | 678M| 2.9M| 681M|87.2T/ 104T( 84%)| 167G/ 1.4T( 11%) 12|10.99.2.9 | OK | 0| 123k| 123k|87.1T/ 104T( 84%)| 167G/ 1.4T( 11%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 1.5G| 7.7M| 1.5G| 349T/ 417T( 84%)| 669G/ 5.7T( 11%) Health Fields: D = Down, A = Attention, S = Smartfailed, R = Read-Only
소스에는 286T의 사용된 HDD 스토리지만 있습니다.
Cluster Name: SOURCE-POWERSCALE Cluster Health: [ ATTN] Data Reduction: 1.00 : 1 Storage Efficiency: 0.71 : 1 Cluster Storage: HDD SSD Storage Size: 417.2T (432.5T Raw) 5.7T (5.7T Raw) VHS Size: 15.4T Used: 285.5T (68%) 721.9G (12%) ========> Avail: 131.7T (32%) 5.0T (88%) Health Throughput (bps) HDD Storage SSD Storage ID |IP Address |DASR | In Out Total| Used / Size |Used / Size ---+---------------+-----+-----+-----+-----+-----------------+----------------- 9|10.99.3.13 | OK | 290M| 9.9M| 300M|71.4T/ 104T( 68%)| 180G/ 1.4T( 12%) 10|10.99.3.11 | OK | 324M| 832M| 1.2G|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 11|10.99.3.12 | OK | 194M| 8.4M| 202M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) 12|10.99.3.10 | OK | 1.9M| 2.0M| 3.8M|71.4T/ 104T( 68%)| 181G/ 1.4T( 12%) ---+---------------+-----+-----+-----+-----+-----------------+----------------- Cluster Totals: | 809M| 852M| 1.7G| 286T/ 417T( 68%)| 722G/ 5.7T( 12%)
Причина
syncIQ 관계에서 클러스터 간 공간 차이에 대한 일반적인 원인은 다음과 같습니다.
/ifs/.ifsvar (가장 일반적인)
--스냅샷 크기의
차이 -- 보호 수준의
차이 -- 수집 작업이 한 클러스터에서 실행되지 않아 분리된 디스크 블록을 확보하지 못합니다.
--내부에 있는 대용량 지원 관련 파일/폴더 /ifs/data/Isilon_Support
Разрешение
모든 syncIQ 작업이 복제를 통해 최신 상태라고 가정하고 다음을 확인합니다.
1) 더 많은 공간을 사용하는 클러스터에 다음 안에 있는 대용량 시스템 파일 또는 감사 로그가 있는 경우가 많습니다. /ifs/.ifsvar을 클릭합니다.
각 클러스터의 화면 세션에서(명령이 반환되는 데 시간이 오래 걸릴 수 있음) 다음을 실행합니다.
# du -sh /ifs/.ifsvar
각 클러스터에서 이 명령을 실행합니다.
PowerScale 지원에서는 과거에 특히 대규모 감사 로그 때문에 이 문제가 원인으로 지목되었습니다.
를 확인하십시오. /ifs/.ifsvar/audit 디렉토리 및 다음 하위 디렉토리,
Where <nodeXXX> is the node ID (for example node001):/ifs/.ifsvar/audit/logs/.
/ifs/.ifsvar/audit/logs/<nodeXXX>
/ifs/.ifsvar/audit/logs/<nodeXXX>/protocol
필요한 경우 KB 000167091Powerscale: 감사 로그 파일을 제거하는 방법 문서를
통해 감사 파일을 삭제합니다.
2) 두 클러스터 간의 보호 수준에 차이가 없는지 확인합니다.
라이브 클러스터:
isi stat -p -q -v
로그:
# cat <base log set>/local/isi_stat-p
Dell Technologies는 또한 diskpools 지원 지원을 통한 내부 명령을 통한 보호 수준.
3) 각 클러스터에서 다음 명령을 실행하여 두 클러스터 간의 스냅샷 사용량에 큰 차이가 없는지 확인합니다.
# isi snapshot usage
4) 더 많은 사용 공간을 보고하는 클러스터에서 /ifs/data/Isilon_Support:
# du -so /ifs/data/Isilon_Support
5) 여전히 문제가 해결되지 않으면 다음 단계는 각 클러스터에서 Collect가 마지막으로 실행된 시기를 확인하는 것입니다.
(참고: 'MultiScan'이 항상 수집 작업을 실행하는 것은 아닙니다.)
이 Collect 작업은 클러스터에서 오래된 디스크 블록을 확보하며, 한 클러스터가 다른 클러스터보다 사용된 디스크 공간이 더 많은 이유를 원인으로 삼을 수 있습니다. 이를 수행하는 한 가지 빠른 방법은 /var/log/messages 예를 들어 마지막으로 Collect가 성공적으로 실행된 노드에서 다음을 수행합니다.
# grep Collect /var/log/messages|grep Succeed
# zgrep Collect /var/log/messages*
6) 여전히 붙어있는 경우 실행하십시오. FSAnalyze 작업을 수행하고 InsightIQ를 사용하여 사용된 공간이 더 많은 클러스터에서 더 많은 공간을 차지하는 폴더를 확인합니다.
'isi stat heat' 더 꽉 찬 클러스터의 명령은 새 쓰기가 발생하는 위치에 대한 몇 가지 단서를 제공할 수도 있습니다.