PowerEdge: Чому жорсткі диски виходять з ладу
Summary: У цій статті детально пояснюються різні причини, через які жорсткі диски можуть виходити з ладу.
Instructions
Зміст
- Пошкодження прошивки та пошкодження зони прошивки
- Електронна несправність
- Механічна несправність
- Логічна помилка
- Медіа-помилки
- Середовище SCSI/SAS
- Попередження щодо відмов дисків PowerEdge
Пошкодження прошивки та пошкодження зони прошивки
Коли прошивка жорсткого диска пошкоджується або стає нечитабельною, комп'ютер часто не може коректно взаємодіяти з жорстким диском.
Електронна несправність
Електронна несправність зазвичай пов'язана з проблемами на платі контролера жорсткого диска. Сервер може зазнати стрибка потужності або електричний стрибок, який виведе з ладу плату контролера на жорсткому диску, роблячи її непомітною для BIOS.
Механічна несправність
Механічна несправність часто (особливо якщо не діяти на ранньому етапі) призводить до часткової, а іноді й повної втрати даних. Механічні несправності бувають різних форм, таких як відмова головки читання/запису та проблеми з двигуном. Однією з найпоширеніших механічних несправностей є зіткнення з головою. Різна за ступенем ступеня аварія голови відбувається, коли головки для читання/запису жорсткого диска стикаються тимчасово або безперервно з пластинами жорсткого диска.
Причин можуть спричинити зіткнення з головою, зокрема фізичний розряд (наприклад, падіння диска на підлогу), рух комп'ютера, статична електрика, стрибки напруги та відмова механічної головки читання/запису.
Логічна помилка
Логічні помилки часто є найпростішими і найскладнішими задачами. Логічні помилки можуть варіюватися від простих речей, таких як некоректний запис у таблиці розподілу файлів, до справді жахливих проблем, таких як пошкодження та втрата файлової системи на сильно фрагментованому диску.
Логічні помилки відрізняються від описаних вище електричних і механічних проблем, оскільки зазвичай з диском немає «фізичних» проблем, окрім інформаційних бітів на ньому.
Медіа-помилки
Погані сектори — це ділянки жорсткого диска, які стають нечитабельними. Усі жорсткі диски з часом мають проблеми з секторами. Жорсткий диск позначає сектори, які виходять з ладу, і вони більше не використовуються. Але якщо у вас є дані, що знаходяться на секторах, що стають поганими, ви не можете правильно отримати доступ до своїх даних чи файлів. Жорсткі робочі умови (такі як високі температури, вібрації тощо) можуть призвести до швидкого утворення багатьох несправних секторів на жорстких дисках. Кожен тип жорсткого диска схильний до виникнення несправних секторів «природно», але це не завжди так.
Середовище SCSI/SAS
Жорсткі диски SCSI часто вважаються високопродуктивними приводами. Вони обертаються швидше, ніж їхні аналоги IDE/SATA, тому швидкість передачі даних часто вища. Через це SCSI-диски часто зустрічаються на серверах, які мають забезпечити велику пропускну здатність даних. Однак ця продуктивність часто має свою ціну, оскільки механічні несправності частіше трапляються на цих дисках.
Найпоширенішою причиною численних відмов диска в цьому середовищі є погана якість сигналу на шині SCSI. Погана якість сигналу може призвести до накладних витрат протоколу SCSI, коли він намагається відновитися після цих проблем (тайм-аути та скидання шини). Зі збільшенням навантаження системи та зростанням попиту на дані коригувальні дії протоколу SCSI збільшуються, і шина SCSI наближається до насичення. Ці накладні витрати зрештою обмежують звичайну пропускну здатність пристрою. Якщо пристрій не очищений, один або кілька SCSI-пристроїв можуть не відповідати на RAID-контролер вчасно, через що RAID-контролер позначить жорсткий диск як офлайн. Неправильне встановлення контролера RAID у слот PCI, погане підключення кабелів, погане розміщення дисків на задній панелі SCSI, неправильне встановлення або розміщення дочірніх карт бекплейн та неправильне завершення шини SCSI можуть спричинити такі проблеми з сигналом.
Можливі також комбінації цих типів
відмов.Усі техніки та клієнти повинні ознайомитися з найкращими практиками обслуговування, щоб максимізувати час безперервної роботи та запобігти втраті даних внаслідок відмови жорсткого диска.
Попередження щодо відмов дисків PowerEdge
При роботі з відмовами диска на серверах PowerEdge важливо дотримуватися наступних заходів безпеки:
- Резервні дані: Завжди робіть резервне копіювання критичних даних перед тим, як діяти на дисках. Це гарантує безпеку даних у разі подальших проблем.
- Сповіщення про моніторинг: Звертайте увагу на прогнозні сповіщення про відмову приводу (код помилки
PDR6) та інші коди помилок, пов'язані з диском (наприклад,PDR1001таPDR3). Ці сповіщення вказують на потенційні проблеми, які потребують негайної уваги. - Оновлення прошивки: Перед заміною будь-якого обладнання переконайтеся, що прошивка для RAID-контролера та дисків є актуальною. Це може допомогти запобігти хибним сповіщенням і покращити загальну стабільність системи.
- Обережно поводьтеся з дисками: Під час зняття, встановлення або встановлення жорстких дисків уникайте надмірного навантаження. Це може зігнути бекплейн і потенційно призвести до відмови або втрати зв'язку сусідніх дисків.
- Перевірте зв'язки: Якщо диск зазначений як несправний, пересадіть диск, щоб виключити проблеми з підключенням. Переконайтеся, що всі з'єднання захищені.
- Журнали перевірки системи: Регулярно перевіряйте журнали iDRAC та системні журнали на наявність пов'язаних сповіщень або теплових подій, які можуть свідчити про приховані проблеми.
- Зв'яжіться зі службою підтримки: Якщо кілька дисків повідомляють про помилки або проблеми залишаються після виконання вищезазначених дій, зверніться до служби підтримки Dell для подальшої допомоги.