Wiki
Инфраструктура

Load Average — что это простыми словами

Load Average — среднее число процессов в очереди на CPU за 1/5/15 минут. LA выше числа ядер = система перегружена. Основа диагностики Linux-сервера.

Load Average — три числа в выводе `uptime`, `top`, `w`, показывающие среднее количество процессов, ожидающих CPU или в состоянии "D" (uninterruptible I/O wait) за последние 1, 5 и 15 минут.

Как читать: если у вас 4 ядра и LA = 4.0 — CPU на 100 %, но процессы не ждут. LA = 2.0 — 50 %, есть запас. LA = 8.0 — критическая перегрузка, каждый процесс ждёт очереди. Тренд важнее абсолютной цифры: LA 15-мин > LA 1-мин = проблема нарастает.

Однако LA считает не только CPU, но и процессы в iowait. Если у вас load average 20 при 4 ядрах, но CPU в top-е 30 % — узкое место в диске, а не в CPU. Смотрите `iostat -x 1` и колонку %util.

На k8s-нодах при этом LA часто высокий из-за короткоживущих контейнеров — не всегда индикатор реальной проблемы. Ориентируйтесь на 99-й перцентиль latency ваших приложений, а не только на LA.

Частые вопросы

Норма LA у моего VPS?
Верхняя граница = число vCPU. LA 2 при 2 vCPU — предел мощности, но приложение работает. LA 4+ при 2 vCPU — тюнинг или апгрейд тарифа.
Как узнать, кто грузит?
`top` + shift+p (по CPU) или `htop`. Для дисков — `iotop`.

Смотрите также