БлогVPS и облако
SERVER1 Logo Dark Icon
VPS и облако

Monitoring Linux VPS: как правильно читать CPU, RAM, Disk и Load

Цель Linux VPS monitoring - не собрать максимальное число графиков. Нужно понимать CPU, RAM, disk и load в контексте workload. Пятиминутный health check Metric Вопро

SERVER1.GE1 мин. чтения
Monitoring Linux VPS: как правильно читать CPU, RAM, Disk и Load

Цель Linux VPS monitoring - не собрать максимальное число графиков. Нужно понимать CPU, RAM, disk и load в контексте workload.

Пятиминутный health check

MetricВопросTool
CPUbusy, steal, iowait?`top`, `mpstat`
RAMavailable, swap, OOM?`free -h`
Diskcapacity, inodes, latency?`df`, `iostat`
Loadrunnable/I/O wait?`uptime`

Load average - не CPU percentage

Load average учитывает runnable tasks и tasks, ожидающие disk I/O. Load 4 на 4-vCPU может означать разные проблемы.

Мало free RAM не всегда проблема

Linux использует RAM как page cache. Смотрите available, swap и OOM. При активном swap читайте гайд по swap на VPS.

Disk: capacity и latency

  • `df -h`;
  • `df -i`;
  • `iostat`;
  • logs.

Background jobs могут создавать spikes - см. background workers guide.

Alert - не один threshold

Лучше объединять duration и symptom, а не просто CPU > 80%.

Baseline до incident

  1. нормальные CPU/RAM/disk/load;
  2. peak часы;
  3. deployment/backup windows;
  4. trend history;
  5. owner и first action для alert.

Смотрите server management tools и downtime guide. На Unmanaged VPS monitoring ваш, для ресурсов смотрите SERVER1 VPS.

Хороший monitoring объясняет не только что metric высокий, но и что от этого страдает.
SERVER1.GE

Не уверены, какая инфраструктура подходит для этой нагрузки?

Расскажите, что вы запускаете, какой трафик ожидаете и какая инфраструктура используется сейчас. Мы поможем сузить выбор.

Спросить SERVER1