PowerScale: Використання AutoBalanceLin для швидкого переміщення даних з повного пулу вузлів
Summary: У цій статті описано, як використати завдання AutoBalanceLin для швидкого звільнення простору, якщо один вузловий пул заповнений або майже на 100% ємності. Цю процедуру слід застосовувати лише тоді, коли всі інші способи звільнення місця на диску в пулі вузлів вичерпані. ...
This article applies to
This article does not apply to
This article is not tied to any specific product.
Not all product versions are identified in this article.
Instructions
Примітка. Наступна процедура вимагає видалення існуючих політик файлового пулу та сміття даних між усіма вузлами незалежно від робочого процесу, до якого належать дані. Без політик File Pool управління даними між пулами чи рівнями не відбувається. Переконайтеся, що наслідки цієї процедури повністю розуміють, оскільки вона може призвести до погіршення продуктивності. Зробити це лише як останній крок після того, як усі інші варіанти вирішення проблем з потужністю вже спробовані.
Широко вважається, що
Тестування на OneFS 8.0 і вище доводить, що це не зовсім так. Якщо кластер має лише стандартну політику File Pool
Це слід використовувати лише як аварійний обхідний шлях для кластерів, які мають один повний пул вузлів. Цей процес швидко переміщує дані з повного пулу вузлів.
Питання: Коли варто застосувати наступну процедуру?
Відповідь: Ця процедура застосовується, коли існують такі умови:
Широко вважається, що
AutoBalance та AutoBalanceLin Дані балансують лише всередині пулів вузлів, а не між пулами вузлів. Також вважається, що це лише smartpools/smartpoolstree може переміщувати дані між двома пулами вузлів.
Тестування на OneFS 8.0 і вище доводить, що це не зовсім так. Якщо кластер має лише стандартну політику File Pool
anywhere:anywhere, AutoBalanceLin та AutoBalance переміщує дані між кількома пулами вузлів.
Це слід використовувати лише як аварійний обхідний шлях для кластерів, які мають один повний пул вузлів. Цей процес швидко переміщує дані з повного пулу вузлів.
Питання: Коли варто застосувати наступну процедуру?
Відповідь: Ця процедура застосовується, коли існують такі умови:
- Кластер містить кілька пулів вузлів, і один або кілька з них заповнені на 100%.
- Існує негайна потреба звільнити дисковий простір на повному пулі вузлів.
- Точна організація даних не є негайною проблемою.
Кроки:
- Запишіть, а потім видаліть усі існуючі політики файлового пулу, окрім стандартної '
any:any' політика файлового пулу, яка налаштовується на кластері.
Перед тим, як перейти до цього кроку:
- Запишіть поточну конфігурацію політики файлового пулу перед видаленням політик. Якщо є час, рекомендується провести повний збір журналу.
- За замовчуванням кластери Isilon налаштовані з політикою Default File Pool, встановленою для запису даних у
'anywhere:anywhere'. Переконайтеся, що політика пулу файлів за замовчуванням повернута до цих стандартних налаштувань перед тим, як рухатися далі.
Приклад: Політика файлового пулу за замовчуванням. Зверніть увагу, що цілі зберігання встановлені на '
anywhere'.
# isi filepool default-policy view
Set Requested Protection: default
Data Access Pattern: concurrency
Enable Coalescer: Yes
Enable Packing: No
Data Storage Target: anywhere
Data SSD Strategy: metadata
Snapshot Storage Target: anywhere
Snapshot SSD Strategy: metadata
Cloud Pool: -
Cloud Compression Enabled: -
Cloud Encryption Enabled: -
Cloud Data Retention: -
Cloud Incremental Backup Retention: -
Cloud Full Backup Retention: -
Cloud Accessibility: -
Cloud Read Ahead: -
Cloud Cache Expiration: -
Cloud Writeback Frequency: -
Cloud Archive Snapshot Files: -
ID: -
- Запусти
SmartPoolsЗавдання для нанесення нових позначок у довідниках:
# isi job start smartpools -p 1 --policy medium
Примітка. Очікуйте
Smartpools завдання виконати швидше, ніж зазвичай, лише anywhere:anywhere Політика файлового пулу за замовчуванням.
Примітка. Через новий дизайн у пізніших версіях OneFS може виникнути наступна помилка при спробі запустити
SmartPools Робота через те, що пул вузлів занадто переповнений:
# isi job jobs start SmartPools Job operation failed: Job 'SmartPools' cannot start because the cluster's free disk space percentage is below 2 (isi_gconfig -t job-config core.free_blocks_pct_threshold_lo threshold) and this job does not free disk space. Free up some space (e.g. run TreeDelete, SnapshotDelete) then try again.: No space left on device
Якщо ви НЕ БАЧИТЕ повідомлення про помилку вище, перейдіть до Кроку 3 нижче.
Якщо ви БАЧИТЕ це повідомлення про помилку, виконайте крок 2a нижче.
- Перевірте ще раз, чи є якісь дані, які можна видалити, щоб звільнити місце на повному пулі вузлів. Це включає перевірку великих знімків, а також перевірку великих системних або аудиторських файлів за допомогою таких команд:
Isilon-28# du -sh /ifs/.ifsvar/audit/logs Islon-28# du -sh /ifs/.ifsvar
Якщо вдасться видалити достатньо даних, спробуйте запустити SmartPools Знову робота.
Якщо абсолютно немає даних, які можна видалити, рекомендований крок для пом'якшення наслідків буде таким:
- Змініть політику пулу файлів за замовчуванням, наведену вище, щоб записувати у менш заповнений пул вузлів.
- Визначте шлях даних у повному пулі вузлів, який містить більшість даних.
- Під час екранної сесії запустіть:
# isi filepool apply -r <data path> to manually move data under a certain path i.e. # isi filepool apply -r /ifs/data/win_data/test_data verify the job is running: # ps auwx | grep apply root 45237 98.1 0.0 102268 61176 0 R+ 13:34 0:35.04 /usr/libexec/isilon/isi /usr/bin/isi filepool apply -r /ifs/
- Контролюйте місткість. Коли повний пул вузлів опиниться нижче 96%, починайте все спочатку з другого кроку, наведеного вище.
- Запусти
AutoBalanceLinПопрацювати кілька годин і слідкувати за простором. (На відміну відAutoBalance, який виконує повний обхід деревом перед переміщенням будь-яких даних,AutoBalanceLinмиттєво змінює дані)
# isi job start autobalancelin -p 1 --policy medium
Майже одразу зверніть увагу, що переміщення даних між пулами вузлів, і повний пул вузлів має звільнити простір на диску.
Примітка. Для цього кроку,
AutoBalanceLin не обов'язково виконується до завершення. Моніторити AutoBalanceLin завдання, доки не буде досягнуто цілі очищення повного пулу вузлів, а потім скасувати завдання. Наприклад, ви можете скасувати завдання, коли повний пул вузлів знизиться до 85% ємності.
Примітка. Відстежуйте використання кластерів і підтверджуйте, що інші завдання скасовані, або зупиніться, якщо простір негативно страждає.
Продовжуйте моніторити простір приблизно кожну годину, поки простір не досягне достатнього рівня, використовуючи наступну команду:
Продовжуйте моніторити простір приблизно кожну годину, поки простір не досягне достатнього рівня, використовуючи наступну команду:
# isi stat -p -v
Примітка. Знову ж таки, не рекомендується дозволяти
Після того, як кластер досягне полегшення у просторі на повному пулі вузлів, скасуйте
AutoBalanceLin Пробігти до завершення. У певний момент робота може змінити напрямок даних і почати давати небажані результати. Наприклад, це змінює рух даних, що може призвести до того, що інший пул вузлів наближається до повної потужності, коли попередній пул спорожніє. Єдиний пробіг AutobalanceLIN На кілька годин або поки простір не буде очищений, а потім скасувати проєкт, коли мети досягнуто.
Після того, як кластер досягне полегшення у просторі на повному пулі вузлів, скасуйте
AutoBalanceLin Робота:
# isi job cancel autobalancelin
Примітка: для оптимальних результатів рівні захисту між пулами вузлів мають бути однаково цінними.
Additional Information
Результати лабораторних досліджень:
Два пули вузлів, рівні захисту
Це було до:
Node Pool Name: x410_archive Protection: +2d:1n Pool Storage: HDD SSD Storage Size: 85.2T (94.6T Raw) 2.2T (2.2T Raw) VHS Size: 9.4T Used: 29.9T (35%) 35.2G (2%) Avail: 55.3T (65%) 2.1T (98%) Throughput (bps) HDD Storage SSD Storage Name Health| In Out Total| Used / Size |Used / Size -------------------+-----+-----+-----+-----+-----------------+----------------- 5|10.5.80.190 | OK |881.6| 0|881.6|10.0T/31.5T( 32%)|11.7G/ 738G( 2%) 6|10.5.80.191 |-A-- | 0| 0| 0|10.0T/31.5T( 32%)|11.7G/ 738G( 2%) 7|10.5.80.192 | OK | 0| 0| 0|10.0T/31.5T( 32%)|11.7G/ 738G( 2%) -------------------+-----+-----+-----+-----+-----------------+----------------- x410_archive | OK |110.2| 0|110.2|29.9T/85.2T( 35%)|35.2G/ 2.2T( 2%) Node Pool Name: x410_35tb_800gb-ssd_64gbProtection: +2d:1n Pool Storage: HDD SSD Storage Size: 112.8T (125.3T Raw) 2.9T (2.9T Raw) VHS Size: 12.5T Used: 5.6T (5%) 7.9G (< 1%) Avail: 107.2T (95%) 2.9T (> 99%) Throughput (bps) HDD Storage SSD Storage Name Health| In Out Total| Used / Size |Used / Size -------------------+-----+-----+-----+-----+-----------------+----------------- 1|10.5.80.186 | OK | 2.9M|82.8M|85.6M| 1.4T/31.5T( 4%)| 2.0G/ 738G(< 1%) 2|10.5.80.187 |-A-- | 104k|38.8k| 143k| 1.4T/30.6T( 5%)| 1.9G/ 738G(< 1%) 3|10.5.80.188 | OK |881.6| 0|881.6| 1.4T/31.5T( 4%)| 2.0G/ 738G(< 1%) 4|10.5.80.189 | OK | 0|25.8k|25.8k| 1.4T/31.5T( 4%)| 2.0G/ 738G(< 1%) -------------------+-----+-----+-----+-----+-----------------+----------------- x410_35tb_800gb-ssd|-M---| 371k|10.4M|10.7M| 5.6T/112.8T( 5%)| 7.9G/ 2.9T(< 1%) _64gb | | | | | | X410-2# date Thu Jun 14 16:53:29 CDT 2018 one filepool policy set to default any:any X410-2# isi job start autobalancelin -p 1 --policy medium Started job [7159] in as little as 30 minutes you will see data shift between the two pools, i.e. our first node pool, below, dropped from 32% full to 29% X410-2# date Thu Jun 14 17:24:20 CDT 2018 Node Pool Name: x410_archive Protection: +2d:1n Pool Storage: HDD SSD Storage Size: 85.2T (94.6T Raw) 2.2T (2.2T Raw) VHS Size: 9.4T Used: 27.7T (33%) 34.3G (2%) Avail: 57.5T (67%) 2.1T (98%) Throughput (bps) HDD Storage SSD Storage Name Health| In Out Total| Used / Size |Used / Size -------------------+-----+-----+-----+-----+-----------------+----------------- 5|10.5.80.190 | OK | 1.1k|25.8k|26.9k| 9.2T/31.5T( 29%)|11.4G/ 738G( 2%) 6|10.5.80.191 |-A-- | 1.1k| 1.2M| 1.2M| 9.2T/31.5T( 29%)|11.4G/ 738G( 2%) 7|10.5.80.192 | OK |28.6k| 5.2k|33.7k| 9.2T/31.5T( 29%)|11.4G/ 738G( 2%) -------------------+-----+-----+-----+-----+-----------------+----------------- x410_archive | OK | 3.8k| 152k| 156k|27.7T/85.2T( 33%)|34.3G/ 2.2T( 2%) Node Pool Name: x410_35tb_800gb-ssd_64gbProtection: +2d:1n Pool Storage: HDD SSD Storage Size: 112.8T (125.3T Raw) 2.9T (2.9T Raw) VHS Size: 12.5T Used: 7.6T (7%) 8.8G (< 1%) Avail: 105.2T (93%) 2.9T (> 99%) Throughput (bps) HDD Storage SSD Storage Name Health| In Out Total| Used / Size |Used / Size -------------------+-----+-----+-----+-----+-----------------+----------------- 1|10.5.80.186 | OK |37.9k| 279k| 316k| 1.9T/31.5T( 6%)| 2.2G/ 738G(< 1%) 2|10.5.80.187 |-A-- | 1.4M|34.8M|36.2M| 1.9T/30.6T( 6%)| 2.2G/ 738G(< 1%) 3|10.5.80.188 | OK | 130k|30.9k| 161k| 1.9T/31.5T( 6%)| 2.2G/ 738G(< 1%) 4|10.5.80.189 | OK | 0| 0| 0| 1.9T/31.5T( 6%)| 2.2G/ 738G(< 1%) -------------------+-----+-----+-----+-----+-----------------+----------------- x410_35tb_800gb-ssd|-M---| 198k| 4.4M| 4.6M| 7.6T/112.8T( 7%)| 8.8G/ 2.9T(< 1%) _64gb | | | | | |
Продовжуйте моніторити приблизно кожну годину, доки дисковий простір не досягне достатнього рівня.
Примітка. Не дозволяйте
AutoBalanceLin Пробігти до завершення. Завдання зміщує дані у протилежному напрямку, що може почати давати небажані результати. Використаний дисковий простір може змінитися, що, можливо, знову призводить до майже повного пулу вузлів. Працювати лише кілька годин.
Одна година:
X410-2# date Thu Jun 14 17:54:30 CDT 2018 Node Pool Name: x410_archive Protection: +2d:1n Pool Storage: HDD SSD Storage Size: 85.2T (94.6T Raw) 2.2T (2.2T Raw) VHS Size: 9.4T Used: 25.2T (30%) 33.9G (2%) Avail: 60.0T (70%) 2.1T (98%) Throughput (bps) HDD Storage SSD Storage Name Health| In Out Total| Used / Size |Used / Size -------------------+-----+-----+-----+-----+-----------------+----------------- 5|10.5.80.190 | OK |881.6|20.6k|21.5k| 8.4T/31.5T( 27%)|11.3G/ 738G( 2%) 6|10.5.80.191 |-A-- | 0| 0| 0| 8.4T/31.5T( 27%)|11.3G/ 738G( 2%) 7|10.5.80.192 | OK | 2.2k| 216k| 218k| 8.4T/31.5T( 27%)|11.3G/ 738G( 2%) -------------------+-----+-----+-----+-----+-----------------+----------------- x410_archive | OK |385.7|29.5k|29.9k|25.2T/85.2T( 30%)|33.9G/ 2.2T( 2%) X410-2# date Thu Jun 14 18:54:43 CDT 2018 Node Pool Name: x410_archive Protection: +2d:1n Pool Storage: HDD SSD Storage Size: 85.2T (94.6T Raw) 2.2T (2.2T Raw) VHS Size: 9.4T Used: 21.6T (25%) 26.8G (1%) Avail: 63.6T (75%) 2.1T (99%) Throughput (bps) HDD Storage SSD Storage Name Health| In Out Total| Used / Size |Used / Size -------------------+-----+-----+-----+-----+-----------------+----------------- 5|10.5.80.190 | OK |22.9k| 1.4M| 1.5M| 7.2T/31.5T( 23%)| 8.9G/ 738G( 1%) 6|10.5.80.191 |-A-- |881.6| 231k| 232k| 7.2T/31.5T( 23%)| 8.9G/ 738G( 1%) 7|10.5.80.192 | OK | 0| 0| 0| 7.2T/31.5T( 23%)| 8.9G/ 738G( 1%) -------------------+-----+-----+-----+-----+-----------------+----------------- x410_archive | OK | 3.0k| 210k| 213k|21.6T/85.2T( 25%)|26.8G/ 2.2T( 1%)
Простір достатньо очищений. The AutoBalanceLIn Роботу можна скасувати, оскільки бажані результати досягнуті.
Affected Products
Isilon X400Article Properties
Article Number: 000009283
Article Type: How To
Last Modified: 08 محرم 1448
Version: 9
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.