PowerScale OneFS: Усунення проблем із продуктивністю

Summary: Виріште повільну продуктивність PowerScale OneFS за допомогою комплексного посібника з налаштування мережі, обробки навантаження та моніторингу за допомогою InsightIQ для підвищення ефективності кластера. ...

This article applies to This article does not apply to This article is not tied to any specific product. Not all product versions are identified in this article.

Symptoms

Клієнтські комп'ютери працюють повільно. Конкретні завдання, особливо ті, що працюють на кластері, або не справляються, або займають більше часу, ніж очікувалося.

Cause

Проблеми з продуктивністю зазвичай виникають через мережевий трафік, проблеми з конфігурацією мережі, навантаження на обробку клієнтів або кластер, або їх поєднання. У цій статті описано кілька ефективних способів усунення проблем із продуктивністю.

Resolution

Усунення несправностей з InsightIQ

Зміст:

  • Використання Isilon InsightIQ
  • Усунення несправностей без InsightIQ
  • Пропускна здатність мережі
  • Розподіл клієнтських з'єднань
  • Кластерна пропускна здатність
  • Кластерна обробка
  • Операції в черзі
  • CPU

Використання Isilon InsightIQ

Використання Isilon InsightIQ — найкращий спосіб моніторити продуктивність і усунути проблеми з продуктивністю.

Віртуальний пристрій Isilon InsightIQ дозволяє моніторити та аналізувати активність кластера Isilon за допомогою гнучких, налаштовуваних зображень діаграм у веб-додатку InsightIQ. Ці діаграми надають детальну інформацію про апаратне забезпечення, програмне забезпечення кластерів, а також операції файлових систем і протоколів. InsightIQ перетворює дані на візуальну інформацію, яка підкреслює будь-які винятки продуктивності, що дозволяє швидко діагностувати вузькі місця або оптимізувати робочі процеси.

Детальніше про використання InsightIQ див. PowerScale InsightIQ - Інформаційний хаб

Усунення несправностей без InsightIQ

Якщо ви не використовуєте InsightIQ, ви можете виконати різні команди для дослідження проблем з продуктивністю. Спочатку вивчайте проблеми з продуктивністю, аналізуючи пропускну здатність мережі та кластерів, потім обробку кластерів і, нарешті, аналізуючи частоти процесорів окремих вузлів.

Пропускна здатність мережі

Використовуйте інструмент для мережевого тестування, наприклад Iperf або Iperf3 щоб визначити пропускну здатність кластера та клієнтських комп'ютерів у вашій мережі.

Використання Iperf, виконує наступні команди на кластері та клієнті. Ці команди визначають розмір вікна, достатньо великий, щоб визначити, чи є мережеве з'єднання потенційною причиною затримки.

  • Кластер: iperf -s -w 262144
  • Клієнт: iperf -c <cluster IP> -w 262144

Використання Iperf3, виконує наступні команди на кластері та клієнті. Ці команди визначають розмір вікна, достатньо великий, щоб визначити, чи є мережеве з'єднання потенційною причиною затримки.

  • Кластер: iperf3 -s -w 262144
  • Клієнт: iperf3 -c <cluster IP> -w 262144


Розподіл клієнтських з'єднань

Перевірте, скільки клієнтів Network File System (NFS) та Server Message Block (SMB) підключено до кластера, щоб переконатися, що вони не віддають перевагу одному вузлу.

  1. Відкрийте SSH-з'єднання на будь-якому вузлі кластера та увійдіть у систему за допомогою root Рахунок.
  2. Запусти isi statistics query current list --nodes=all --keys=node.clientstats.connected.nfs,node.clientstats.active.nfs -d команду перевірити клієнти NFS. 
    Вихід показує кількість підключених клієнтів на вузол і кількість із них активних на кожному вузлі.
  3. Запусти isi statistics query current list --keys=node.clientstats.connected.smb,node.clientstats.active.smb1,node.clientstats.active.smb2 -n all -d команда перевірити клієнтів SMB.
    Вихід показує кількість підключених клієнтів на вузол і кількість із них активних на кожному вузлі.

Кластерна пропускна здатність

Оцінюйте пропускну здатність кластера, проводячи тести запису та читання, які вимірюють час, необхідний для читання та запису файлу. Проведіть принаймні один письмовий і один тест на читання, наступним чином.

Напиши тест.

  1. Відкрийте SSH-з'єднанняна будь-якому вузлі кластера та увійдіть у систему за допомогою root Рахунок.
  2. Зміна на /ifs Довідник: cd /ifs
  3. З інтерфейсу командного рядка (CLI) кластера або з клієнтського комп'ютера UNIX чи Linux використовуйте dd команду для запису нового файлу в кластер.
    Виконайте таку команду: dd if=/dev/zero of=1GBfile bs=1024k count=1024
    Ця команда створює зразковий файл розміром 1 ГБ і повідомляє про час, необхідний для запису на диск.
  4. З результатів цієї команди екстраполюйте, скільки МБ за секунду можна записати на диск у однопотокових робочих процесах.
  5. Якщо у вас є MAC-клієнт і ви хочете провести додатковий аналіз,
    1. Запусти монітор активності.
    2. Запусти cat /dev/zero > /pathToFile команди, де pathToFile — це шлях до цільового файлу.
      Ця команда допомагає вимірювати пропускну здатність операцій запису на кластері Isilon. (Хоча можливо запустити dd від MAC-клієнта, результати можуть бути непослідовними.)
    3. Відстежуйте результати команди у вкладці «Мережа » монітора активності.

Прочитайте тест.
При вимірюванні пропускної здатності операцій читання обов'язково не проводьте тести читання файлу, створеного під час тесту запису. Оскільки цей файл був кешований, результати ваших тестів читання будуть неточними. Натомість перевірте операцію читання файлу, який не був кешований. Знайдіть файл у кластері, який більший за 1GB, і посилайтеся на цей файл у тесті читання.

  1. Відкрийте SSH-з'єднання на будь-якому вузлі кластера та увійдіть у систему за допомогою root Рахунок.
  2. Від CLI на кластері або з клієнтського комп'ютера UNIX чи Linux використовуйте dd команду для зчитування файлу на кластері.
    Запусти dd if=/pathToLargeFile of=/dev/null bs=1024k командувати, де pathToFile — це шлях до цільового файлу.
    Ця команда зчитує цільовий файл і повідомляє про час, необхідний для його прочитання.
  3. Якщо у вас є MAC-клієнт і ви хочете провести додатковий аналіз,
    1. Запусти монітор активності.
    2. Запусти time cp /pathToLargeFile > /dev/null командувати, де pathToFile — це шлях до цільового файлу.
      Ця команда допомагає вимірювати пропускну здатність операцій читання на кластері Isilon. (Хоча можливо запустити dd від MAC-клієнта, результати можуть бути непослідовними.)
    3. Відстежуйте результати команди у вкладці «Мережа » монітора активності.

Кластерна обробка

Переробка робіт.
Перед розглядом операцій вводу/виведення (IOPS) кластера:

  • Визначте, які завдання працюють на кластері. Якщо виконуються завдання для перерозподілу, такі як Auto-Balance, Collect або MultiScan, подумайте, чому ці завдання виконуються і чи варто їм продовжувати працювати.
  • Розглянемо тип даних, які споживаються. Якщо клієнтські комп'ютери працюють із великими відеофайлами або віртуальними машинами (VM), завдання restriped вимагає більшої кількості IOPS на диску, ніж зазвичай.
  • Розгляньте можливість тимчасово призупинити роботу з перечистки. Це може покращити продуктивність і стати життєздатним короткостроковим рішенням проблеми з продуктивністю.

Ввод/
вивід дискаАналіз вводу/виводу диска може допомогти визначити, чи не використовуються певні диски надмірно.

За кластером

  1. Відкрийте SSH-з'єднання на будь-якому вузлі кластера та увійдіть у систему через обліковий запис "root".
  2. Запусти isi statistics pstat команду для визначення дискового введення/виведення
  3. Від виводу цієї команди розділіть IOPS диска на загальну кількість дисків у кластері. Наприклад, для кластеру з 8 вузлів, що використовує Isilon IQ 12000x вузлів, який містить 12 дисків на вузол, ви ділите IOPS диска на 96
    .Для вузлів серії X і NL-Series слід очікувати IOPS диска 70 або менше для 100% випадкових робочих процесів, або IOPS диска 140 або менше для 100% послідовних робочих процесів. Оскільки вузли серії NL мають менше оперативної пам'яті та нижчу швидкість процесорів, ніж вузли серії X, вузли серії X-серії можуть обробляти вищі IOPS диска.

За вузлом і за диском

  1. Відкрийте SSH-з'єднання на будь-якому вузлі кластера та увійдіть у систему через обліковий запис "root".
  2. Запусти isi statistics query current --nodes=all --stats=node.disk.xfers.rate.sum --format=top команду для визначення IOPS диска за вузлом, що допомагає виявити диски, які використовуються надмірно.
  3. Запусти isi_stats_tool -a get_key_info|grep node.disk.xfer команду для визначення запиту статистики на кожному диску.

Операції в черзі

Ще один спосіб визначити, чи диски надмірно використовуються, — визначити, скільки операцій поставлено в чергу для кожного диска в кластері. Для однопотокового робочого процесу на основі SMB черга з чотирьох може свідчити про проблему, тоді як для операцій з високою паралелізацією NFS черга більша.

  1. Відкрийте SSH-з'єднання на будь-якому вузлі кластера та увійдіть у систему за допомогою root Рахунок.
  2. Запусти isi statistics drive list --nodes=all --sort=queued -d команду для визначення, скільки операцій поставлено в чергу для кожного диска в кластері.
  3. Визначте, скільки часу була операція в черзі: isi statistics drive list --nodes=all --sort=queued -d 

CPU

Проблеми з процесором часто пов'язані з операціями, які клієнти виконують у кластері. Використовуючи isi statistics ви можете визначити операції, виконані на кластері, каталогізовані або мережевим протоколом, або клієнтським комп'ютером.

  1. Відкрийте SSH-з'єднання на будь-якому вузлі кластера та увійдіть у систему за допомогою root Рахунок.
  2. Запусти isi statistics protocol list --long --totalby Op,proto -d --sort TimeAvg --format top Команда визначає, які операції виконуються в мережі, і яка з них займає найбільше часу.
    Цей вихід команди надає детальну статистику для всіх мережевих протоколів, організовану за тим, скільки часу кластер відповідає клієнтам. Хоча результати цієї команди можуть не визначити, яка операція є найповільнішою, вона може вказати вам правильний напрямок.
  3. Запусти isi statistics system --nodes all --format top щоб отримати більше інформації про обробку процесорами, наприклад, які процесори вузлів використовуються найчастіше.
  4. Запусти isi_for_array -sX 'top -u -n |grep PID -A4' команду для отримання чотирьох процесів на кожному вузлі, які споживають найбільше ресурсів процесора.

Additional Information

Пов'язані ресурси
Ось рекомендовані ресурси, пов'язані з цією темою, які можуть зацікавити:

Affected Products

PowerScale, PowerScale OneFS

Products

Isilon, PowerScale OneFS
Article Properties
Article Number: 000015384
Article Type: Solution
Last Modified: 19 أيار 2026
Version:  15
Find answers to your questions from other Dell users
Support Services
Check if your device is covered by Support Services.