PowerScale: Використання AutoBalanceLin для швидкого переміщення даних з повного пулу вузлів

Summary: У цій статті описано, як використати завдання AutoBalanceLin для швидкого звільнення простору, якщо один вузловий пул заповнений або майже на 100% ємності. Цю процедуру слід застосовувати лише тоді, коли всі інші способи звільнення місця на диску в пулі вузлів вичерпані. ...

This article applies to This article does not apply to This article is not tied to any specific product. Not all product versions are identified in this article.

Instructions

Примітка. Наступна процедура вимагає видалення існуючих політик файлового пулу та сміття даних між усіма вузлами незалежно від робочого процесу, до якого належать дані. Без політик File Pool управління даними між пулами чи рівнями не відбувається. Переконайтеся, що наслідки цієї процедури повністю розуміють, оскільки вона може призвести до погіршення продуктивності. Зробити це лише як останній крок після того, як усі інші варіанти вирішення проблем з потужністю вже спробовані.

Широко вважається, що AutoBalance та AutoBalanceLin Дані балансують лише всередині пулів вузлів, а не між пулами вузлів. Також вважається, що це лише smartpools/smartpoolstree може переміщувати дані між двома пулами вузлів.

Тестування на OneFS 8.0 і вище доводить, що це не зовсім так. Якщо кластер має лише стандартну політику File Pool anywhere:anywhere, AutoBalanceLin та AutoBalance переміщує дані між кількома пулами вузлів.

Це слід використовувати лише як аварійний обхідний шлях для кластерів, які мають один повний пул вузлів. Цей процес швидко переміщує дані з повного пулу вузлів.

Питання: Коли варто застосувати наступну процедуру?
Відповідь: Ця процедура застосовується, коли існують такі умови:
  • Кластер містить кілька пулів вузлів, і один або кілька з них заповнені на 100%.
  • Існує негайна потреба звільнити дисковий простір на повному пулі вузлів.
  • Точна організація даних не є негайною проблемою.


Кроки:

  1. Запишіть, а потім видаліть усі існуючі політики файлового пулу, окрім стандартної 'any:any' політика файлового пулу, яка налаштовується на кластері.

Перед тим, як перейти до цього кроку:

  • Запишіть поточну конфігурацію політики файлового пулу перед видаленням політик. Якщо є час, рекомендується провести повний збір журналу.
  • За замовчуванням кластери Isilon налаштовані з політикою Default File Pool, встановленою для запису даних у 'anywhere:anywhere'. Переконайтеся, що політика пулу файлів за замовчуванням повернута до цих стандартних налаштувань перед тим, як рухатися далі.
Приклад: Політика файлового пулу за замовчуванням. Зверніть увагу, що цілі зберігання встановлені на 'anywhere'.
# isi filepool default-policy view
          Set Requested Protection: default
               Data Access Pattern: concurrency
                  Enable Coalescer: Yes
                    Enable Packing: No
               Data Storage Target: anywhere
                 Data SSD Strategy: metadata
           Snapshot Storage Target: anywhere
             Snapshot SSD Strategy: metadata
                        Cloud Pool: -
         Cloud Compression Enabled: -
          Cloud Encryption Enabled: -
              Cloud Data Retention: -
Cloud Incremental Backup Retention: -
       Cloud Full Backup Retention: -
               Cloud Accessibility: -
                  Cloud Read Ahead: -
            Cloud Cache Expiration: -
         Cloud Writeback Frequency: -
      Cloud Archive Snapshot Files: -
                                ID: -
  1. Запусти SmartPools Завдання для нанесення нових позначок у довідниках:
# isi job start smartpools -p 1 --policy medium
 
Примітка. Очікуйте Smartpools завдання виконати швидше, ніж зазвичай, лише anywhere:anywhere Політика файлового пулу за замовчуванням.
 
Примітка. Через новий дизайн у пізніших версіях OneFS може виникнути наступна помилка при спробі запустити SmartPools Робота через те, що пул вузлів занадто переповнений:
# isi job jobs start SmartPools

Job operation failed: Job 'SmartPools' cannot start because the cluster's free disk space percentage is below 2 (isi_gconfig -t job-config core.free_blocks_pct_threshold_lo threshold) and this job does not free disk space. Free up some space (e.g. run TreeDelete, SnapshotDelete) then try again.: No space left on device

Якщо ви НЕ БАЧИТЕ повідомлення про помилку вище, перейдіть до Кроку 3 нижче.

Якщо ви БАЧИТЕ це повідомлення про помилку, виконайте крок 2a нижче.

  1. Перевірте ще раз, чи є якісь дані, які можна видалити, щоб звільнити місце на повному пулі вузлів. Це включає перевірку великих знімків, а також перевірку великих системних або аудиторських файлів за допомогою таких команд:
Isilon-28# du -sh /ifs/.ifsvar/audit/logs
 
Islon-28# du -sh /ifs/.ifsvar

Якщо вдасться видалити достатньо даних, спробуйте запустити SmartPools Знову робота.

Якщо абсолютно немає даних, які можна видалити, рекомендований крок для пом'якшення наслідків буде таким:

  1. Змініть політику пулу файлів за замовчуванням, наведену вище, щоб записувати у менш заповнений пул вузлів. 
  2. Визначте шлях даних у повному пулі вузлів, який містить більшість даних.
  3. Під час екранної сесії запустіть:   
# isi filepool apply -r <data path>   to manually move data under a certain path

i.e.

# isi filepool apply -r /ifs/data/win_data/test_data

verify the job is running:

# ps auwx | grep apply
root   45237   98.1  0.0 102268  61176  0  R+   13:34          0:35.04 /usr/libexec/isilon/isi /usr/bin/isi filepool apply -r /ifs/
  1. Контролюйте місткість. Коли повний пул вузлів опиниться нижче 96%, починайте все спочатку з другого кроку, наведеного вище.
  1. Запусти AutoBalanceLin Попрацювати кілька годин і слідкувати за простором. (На відміну від AutoBalance, який виконує повний обхід деревом перед переміщенням будь-яких даних, AutoBalanceLin миттєво змінює дані)
# isi job start autobalancelin -p 1 --policy medium

Майже одразу зверніть увагу, що переміщення даних між пулами вузлів, і повний пул вузлів має звільнити простір на диску.
 
Примітка. Для цього кроку, AutoBalanceLin не обов'язково виконується до завершення. Моніторити AutoBalanceLin завдання, доки не буде досягнуто цілі очищення повного пулу вузлів, а потім скасувати завдання. Наприклад, ви можете скасувати завдання, коли повний пул вузлів знизиться до 85% ємності.
 
Примітка. Відстежуйте використання кластерів і підтверджуйте, що інші завдання скасовані, або зупиніться, якщо простір негативно страждає.

Продовжуйте моніторити простір приблизно кожну годину, поки простір не досягне достатнього рівня, використовуючи наступну команду:
# isi stat -p -v
 
Примітка. Знову ж таки, не рекомендується дозволяти AutoBalanceLin Пробігти до завершення. У певний момент робота може змінити напрямок даних і почати давати небажані результати. Наприклад, це змінює рух даних, що може призвести до того, що інший пул вузлів наближається до повної потужності, коли попередній пул спорожніє. Єдиний пробіг AutobalanceLIN На кілька годин або поки простір не буде очищений, а потім скасувати проєкт, коли мети досягнуто.

Після того, як кластер досягне полегшення у просторі на повному пулі вузлів, скасуйте AutoBalanceLin Робота:
# isi job cancel autobalancelin
 
Примітка: для оптимальних результатів рівні захисту між пулами вузлів мають бути однаково цінними. 

Additional Information

Результати лабораторних досліджень:

Два пули вузлів, рівні захисту
Це було до:

Node Pool Name: x410_archive          Protection:        +2d:1n
Pool Storage:     HDD                 SSD Storage
Size:             85.2T (94.6T Raw)   2.2T (2.2T Raw)
VHS Size:         9.4T
Used:             29.9T (35%)         35.2G (2%)
Avail:            55.3T (65%)         2.1T (98%)

                           Throughput (bps)  HDD Storage      SSD Storage
Name               Health|  In   Out  Total| Used / Size     |Used / Size
-------------------+-----+-----+-----+-----+-----------------+-----------------
  5|10.5.80.190    | OK  |881.6|    0|881.6|10.0T/31.5T( 32%)|11.7G/ 738G(  2%)
  6|10.5.80.191    |-A-- |    0|    0|    0|10.0T/31.5T( 32%)|11.7G/ 738G(  2%)
  7|10.5.80.192    | OK  |    0|    0|    0|10.0T/31.5T( 32%)|11.7G/ 738G(  2%)
-------------------+-----+-----+-----+-----+-----------------+-----------------
x410_archive       |  OK |110.2|    0|110.2|29.9T/85.2T( 35%)|35.2G/ 2.2T(  2%)

Node Pool Name: x410_35tb_800gb-ssd_64gbProtection:        +2d:1n
Pool Storage:     HDD                 SSD Storage
Size:             112.8T (125.3T Raw) 2.9T (2.9T Raw)
VHS Size:         12.5T
Used:             5.6T (5%)           7.9G (< 1%)
Avail:            107.2T (95%)        2.9T (> 99%)

                           Throughput (bps)  HDD Storage      SSD Storage
Name               Health|  In   Out  Total| Used / Size     |Used / Size
-------------------+-----+-----+-----+-----+-----------------+-----------------
  1|10.5.80.186    | OK  | 2.9M|82.8M|85.6M| 1.4T/31.5T(  4%)| 2.0G/ 738G(< 1%)
  2|10.5.80.187    |-A-- | 104k|38.8k| 143k| 1.4T/30.6T(  5%)| 1.9G/ 738G(< 1%)
  3|10.5.80.188    | OK  |881.6|    0|881.6| 1.4T/31.5T(  4%)| 2.0G/ 738G(< 1%)
  4|10.5.80.189    | OK  |    0|25.8k|25.8k| 1.4T/31.5T(  4%)| 2.0G/ 738G(< 1%)
-------------------+-----+-----+-----+-----+-----------------+-----------------
x410_35tb_800gb-ssd|-M---| 371k|10.4M|10.7M| 5.6T/112.8T(  5%)| 7.9G/ 2.9T(< 1%)
  _64gb            |     |     |     |     |                 |




X410-2# date
Thu Jun 14 16:53:29 CDT 2018


one filepool policy set to default any:any


X410-2# isi job start autobalancelin -p 1 --policy medium
Started job [7159]


in as little as 30 minutes you will see data shift between the two pools, i.e. our first node pool, below, dropped from 32% full to 29%


X410-2# date
Thu Jun 14 17:24:20 CDT 2018



Node Pool Name: x410_archive          Protection:        +2d:1n
Pool Storage:     HDD                 SSD Storage
Size:             85.2T (94.6T Raw)   2.2T (2.2T Raw)
VHS Size:         9.4T
Used:             27.7T (33%)         34.3G (2%)
Avail:            57.5T (67%)         2.1T (98%)

                           Throughput (bps)  HDD Storage      SSD Storage
Name               Health|  In   Out  Total| Used / Size     |Used / Size
-------------------+-----+-----+-----+-----+-----------------+-----------------
  5|10.5.80.190    | OK  | 1.1k|25.8k|26.9k| 9.2T/31.5T( 29%)|11.4G/ 738G(  2%)
  6|10.5.80.191    |-A-- | 1.1k| 1.2M| 1.2M| 9.2T/31.5T( 29%)|11.4G/ 738G(  2%)
  7|10.5.80.192    | OK  |28.6k| 5.2k|33.7k| 9.2T/31.5T( 29%)|11.4G/ 738G(  2%)
-------------------+-----+-----+-----+-----+-----------------+-----------------
x410_archive       |  OK | 3.8k| 152k| 156k|27.7T/85.2T( 33%)|34.3G/ 2.2T(  2%)

Node Pool Name: x410_35tb_800gb-ssd_64gbProtection:        +2d:1n
Pool Storage:     HDD                 SSD Storage
Size:             112.8T (125.3T Raw) 2.9T (2.9T Raw)
VHS Size:         12.5T
Used:             7.6T (7%)           8.8G (< 1%)
Avail:            105.2T (93%)        2.9T (> 99%)

                           Throughput (bps)  HDD Storage      SSD Storage
Name               Health|  In   Out  Total| Used / Size     |Used / Size
-------------------+-----+-----+-----+-----+-----------------+-----------------
  1|10.5.80.186    | OK  |37.9k| 279k| 316k| 1.9T/31.5T(  6%)| 2.2G/ 738G(< 1%)
  2|10.5.80.187    |-A-- | 1.4M|34.8M|36.2M| 1.9T/30.6T(  6%)| 2.2G/ 738G(< 1%)
  3|10.5.80.188    | OK  | 130k|30.9k| 161k| 1.9T/31.5T(  6%)| 2.2G/ 738G(< 1%)
  4|10.5.80.189    | OK  |    0|    0|    0| 1.9T/31.5T(  6%)| 2.2G/ 738G(< 1%)
-------------------+-----+-----+-----+-----+-----------------+-----------------
x410_35tb_800gb-ssd|-M---| 198k| 4.4M| 4.6M| 7.6T/112.8T(  7%)| 8.8G/ 2.9T(< 1%)
  _64gb            |     |     |     |     |                 |

Продовжуйте моніторити приблизно кожну годину, доки дисковий простір не досягне достатнього рівня.

 
Примітка. Не дозволяйте AutoBalanceLin Пробігти до завершення. Завдання зміщує дані у протилежному напрямку, що може почати давати небажані результати. Використаний дисковий простір може змінитися, що, можливо, знову призводить до майже повного пулу вузлів. Працювати лише кілька годин.

Одна година:
X410-2# date
Thu Jun 14 17:54:30 CDT 2018



Node Pool Name: x410_archive          Protection:        +2d:1n
Pool Storage:     HDD                 SSD Storage
Size:             85.2T (94.6T Raw)   2.2T (2.2T Raw)
VHS Size:         9.4T
Used:             25.2T (30%)         33.9G (2%)
Avail:            60.0T (70%)         2.1T (98%)

                           Throughput (bps)  HDD Storage      SSD Storage
Name               Health|  In   Out  Total| Used / Size     |Used / Size
-------------------+-----+-----+-----+-----+-----------------+-----------------
  5|10.5.80.190    | OK  |881.6|20.6k|21.5k| 8.4T/31.5T( 27%)|11.3G/ 738G(  2%)
  6|10.5.80.191    |-A-- |    0|    0|    0| 8.4T/31.5T( 27%)|11.3G/ 738G(  2%)
  7|10.5.80.192    | OK  | 2.2k| 216k| 218k| 8.4T/31.5T( 27%)|11.3G/ 738G(  2%)
-------------------+-----+-----+-----+-----+-----------------+-----------------
x410_archive       |  OK |385.7|29.5k|29.9k|25.2T/85.2T( 30%)|33.9G/ 2.2T(  2%)


X410-2# date
Thu Jun 14 18:54:43 CDT 2018




Node Pool Name: x410_archive          Protection:        +2d:1n
Pool Storage:     HDD                 SSD Storage
Size:             85.2T (94.6T Raw)   2.2T (2.2T Raw)
VHS Size:         9.4T
Used:             21.6T (25%)         26.8G (1%)
Avail:            63.6T (75%)         2.1T (99%)

                           Throughput (bps)  HDD Storage      SSD Storage
Name               Health|  In   Out  Total| Used / Size     |Used / Size
-------------------+-----+-----+-----+-----+-----------------+-----------------
  5|10.5.80.190    | OK  |22.9k| 1.4M| 1.5M| 7.2T/31.5T( 23%)| 8.9G/ 738G(  1%)
  6|10.5.80.191    |-A-- |881.6| 231k| 232k| 7.2T/31.5T( 23%)| 8.9G/ 738G(  1%)
  7|10.5.80.192    | OK  |    0|    0|    0| 7.2T/31.5T( 23%)| 8.9G/ 738G(  1%)
-------------------+-----+-----+-----+-----+-----------------+-----------------
x410_archive       |  OK | 3.0k| 210k| 213k|21.6T/85.2T( 25%)|26.8G/ 2.2T(  1%)


Простір достатньо очищений. The AutoBalanceLIn Роботу можна скасувати, оскільки бажані результати досягнуті.

Affected Products

Isilon X400
Article Properties
Article Number: 000009283
Article Type: How To
Last Modified: 08 محرم 1448
Version:  9
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.