Краткий ответ: На unmanaged выделенном сервере мониторинг уровня ОС — ваша зона: начните со встроенных инструментов (htop, iostat, df), добавьте агентную систему вроде Netdata, Zabbix или Prometheus node_exporter для истории и алертов и следите за здоровьем дисков через SMART. Cloud2Y со своей стороны мониторит сеть и оборудование.
Обзор
Хороший мониторинг отвечает на три вопроса: здоров ли сервер сейчас, что изменилось перед инцидентом и когда закончатся ресурсы. На выделенном железе следите также за состоянием компонентов (диски, состояние RAID, температуры) — вы работаете на реальных дисках, которые стареют.
Что нужно иметь
- SSH-доступ к серверу.
- Решение: лёгкий дашборд одной ноды (Netdata) или централизованный мониторинг парка (Zabbix/Prometheus + Grafana).
- Куда слать алерты — email или вебхук мессенджера.
Пошаговая инструкция
- База встроенными средствами:
htop # CPU/RAM по процессам iostat -x 5 # нагрузка и задержки дисков df -h # место на дисках ss -tulpn # слушающие сервисы - Установите агент (пример — Netdata, дашборд одной ноды):
wget -O /tmp/netdata-kickstart.sh https://get.netdata.cloud/kickstart.sh sh /tmp/netdata-kickstart.sh - Следите за здоровьем дисков (SMART):
При аппаратном RAID опрашивайте контроллер (напр.apt install smartmontools smartctl -a /dev/sdastorcli/MegaCli) — диски за контроллером не видны обычномуsmartctl. - Регулярно проверяйте состояние RAID — программный RAID:
cat /proc/mdstat. - Настройте алерты на: диск >80% заполнения, деградированный RAID, load стабильно выше числа ядер, давление RAM+swap, рост reallocated-секторов в SMART.
Типичные проблемы
- Мониторить только CPU/RAM: большинство инцидентов на выделенных серверах — дисковые; всегда включайте SMART и состояние RAID.
- Нет истории: всплеск, который негде посмотреть постфактум, — потерянный диагноз; храните метрики хотя бы за несколько недель.
- Усталость от алертов: начните с нескольких высокосигнальных; заглушённый канал хуже, чем никакого.
Когда обращаться в поддержку
Открывайте тикет, когда метрики указывают на железо: ошибки SMART, деградированный RAID-массив, события ECC-памяти в логах или аномальные температуры — мы проведём диагностику и заменим сбойные компоненты.
Частые вопросы
Мониторит ли Cloud2Y мой сервер за меня?
Cloud2Y мониторит сеть и аппаратную среду со своей стороны. Мониторинг операционной системы и приложений на unmanaged выделенном сервере настраиваете и ведёте вы.
Что мониторить в первую очередь?
Начните с места на дисках, их здоровья (SMART и состояние RAID), нагрузки CPU, давления RAM и swap и ключевых сервисов — и настройте алерты, а не только дашборды, которые никто не открывает.
Как проверить диски за аппаратным RAID-контроллером?
Опрашивайте RAID-контроллер его собственной утилитой, например storcli или MegaCli. Обычный smartctl не видит физических дисков, скрытых за аппаратным контроллером.
Похожие статьи
- Как заказать диагностику оборудования
- Как настроить RAID на выделенном сервере
- Как увеличить пропускную способность канала
- SLA выделенных серверов и границы поддержки
Нужна помощь? Связаться с поддержкой Cloud2Y →
