Коротка відповідь: Якщо підозрюєте несправність заліза (помилки дисків, події ECC-пам'яті, випадкові перезавантаження, проблеми з температурою), відкрийте тикет у підтримку із симптомами та витягами з логів. Інженери Cloud2Y проведуть діагностику — частина перевірок потребує виведення сервера офлайн (напр. повні тести пам'яті), тож може узгоджуватися вікно обслуговування. Збійні компоненти замінюються.

Огляд

Залізо рідко відмовляє без попередження: атрибути SMART деградують, лічильники ECC зростають, логи ядра наповнюються I/O-помилками. Раннє виявлення перетворює аварію на планову заміну диска. Ця стаття — про те, що зібрати і як влаштований процес діагностики.

Що потрібно мати

  • Зберіть докази з ОС:
    dmesg -T | grep -iE 'error|fail|mce|i/o'
    journalctl -p err -S -48h
    smartctl -a /dev/sda        # по кожному диску; через storcli/MegaCli за апаратним RAID
    cat /proc/mdstat            # стан програмного RAID
  • Занотуйте закономірності: коли трапляються ребути/фризи, що змінилося останнім часом.
  • Закладіть можливе вікно обслуговування, якщо знадобляться офлайн-тести.

Покрокова інструкція

  1. Відкрийте тикет: ID/IP сервера, симптоми, коли почалися, і витяги з логів вище.
  2. Інженери спершу перевіряють віддалено — сенсори IPMI, журнали подій, стан контролера.
  3. За потреби узгоджується вікно для офлайн-тестів (memtest для RAM, розширені тести дисків).
  4. Отримайте вердикт у тикеті: компонент здоровий, деградує чи запланований на заміну.
  5. Заміна дисків у надлишковому RAID зазвичай робиться наживо; масив потім ребілдиться — стежте за його станом.

Типові проблеми

  • Скарга «сервер повільний» без даних — повільність зазвичай софтова; логи та SMART швидко розділяють ці два випадки.
  • Ігнорування деградованого масиву — з половиною дзеркала ви за одну відмову від втрати даних; повідомляйте одразу.
  • Пропуск бекапів перед офлайн-тестами — діагностика неруйнівна, але будь-яке обслуговування — хороший привід для бекапа.

Коли звертатися в підтримку

Одразу за: повторюваних незрозумілих ребутів, зростання reallocated/pending секторів, подій ECC-помилок, деградації RAID чи температурних тривог. Здоров'я заліза — бік Cloud2Y у межах підтримки; заміна збійних компонентів безплатна.

Часті запитання

Чи платна заміна обладнання?

Ні — діагностика й заміна збійних компонентів входить у послугу виділеного сервера Cloud2Y. На вашому боці лише ОС, наприклад спостереження за ребілдом RAID після заміни.

Чи виведе діагностика сервер офлайн?

Віддалені перевірки — сенсори IPMI та аналіз логів — ідуть наживо. Глибокі тести, як-от повний тест пам'яті, потребують офлайну, тож вікно обслуговування спершу узгоджують з вами.

Які докази додати до тикета?

Додайте витяги помилок із dmesg чи journalctl, вивід SMART по кожному диску, стан RAID і короткий опис, коли з'являються симптоми та що нещодавно змінювалося.

Схожі статті

Потрібна допомога? Звернутися в підтримку Cloud2Y →

Ця відповідь Вам допомогла? 0 Користувачі, які знайшли це корисним (0 Голосів)