Сервер перегружен: какие показатели проверить в первую очередь
Когда 1С и сетевые папки тормозят у всех сразу, первым делом смотрят четыре ресурса сервера: процессор, память, диск и сеть. Чаще всего узким местом оказывается не процессор, а диск — и это видно только по правильному показателю. Разбираем, какие значения считать нормой, какие — тревожными и как найти процесс, который перегружает сервер.
Сначала убедитесь, что проблема именно в сервере
Перегруженный сервер выдаёт себя одним характерным признаком: тормозит у всех, кто с ним работает, и примерно в одно и то же время. Если медленно работает один компьютер, а у соседей всё в порядке, сервер, скорее всего, ни при чём — это случай из статьи «Почему 1С тормозит только у одного сотрудника».
Если же жалуются сразу несколько человек, полезно сначала отделить сервер от сети: как это сделать, разобрано в статье «Почему компьютеры сотрудников начинают тормозить одновременно». Ниже — следующий шаг: что смотреть на самом сервере.
Главное правило: показатели нужно снимать в момент, когда пользователи жалуются. Сервер, открытый вечером или в выходной, почти всегда выглядит здоровым.
Четыре ресурса, которые проверяют в первую очередь
Процессор (CPU)
Кратковременные пики до 100% — нормальная работа: сервер сформировал отчёт или провёл документы и вернулся в спокойное состояние. Проблема начинается, когда загрузка держится на уровне 80–90% и выше десятки минут подряд в обычные рабочие часы.
Второй показатель — очередь процессора (Processor Queue Length). Если она стабильно больше двух задач на каждое ядро, процессы стоят в очереди и ждут, пока освободится процессорное время. Пользователи видят это как «всё думает».
Оперативная память
Здесь важно не то, сколько памяти занято, а сколько осталось свободной и не начал ли сервер активно использовать файл подкачки. Тревожные признаки: доступной памяти (Available MBytes) остаётся меньше 10% от объёма, а диск с файлом подкачки постоянно занят.
Частая ложная тревога — SQL Server. По умолчанию он забирает под кэш почти всю свободную память и отдаёт её неохотно. Сама по себе высокая занятость памяти процессом sqlservr.exe — не перегрузка. Проблема появляется, когда из-за этого не хватает памяти операционной системе и рабочим процессам сервера 1С (rphost.exe). Лечится это обычно ограничением памяти для SQL Server в настройках (max server memory), а не покупкой новых модулей.
Диск — самое частое узкое место
На серверах с базами 1С диск упирается в потолок чаще процессора, и именно здесь чаще всего ошибаются при самостоятельной проверке. Процент загрузки диска в диспетчере задач мало что говорит. Смотреть нужно на время отклика диска — сколько миллисекунд уходит на одну операцию чтения или записи (Avg. Disk sec/Read и Avg. Disk sec/Write).
Для обычных жёстких дисков ориентир такой: до 10 мс — хорошо, 10–20 мс — терпимо, стабильно выше 20–25 мс — диск не успевает, и все, кто работает с сервером, ждут его. Для SSD нормальные значения на порядок ниже, поэтому даже 5–10 мс на твердотельном массиве — уже повод разбираться.
Длину очереди к диску (Disk Queue Length) смотрят как вспомогательный показатель: на RAID-массивах и SSD её трудно интерпретировать без знания конфигурации.
Сеть
Сетевой интерфейс сервера редко бывает главной причиной, но проверить его стоит за минуту. Во-первых, загрузка: если сетевая карта стабильно занята на 70% и больше, канал до сервера становится общим узким местом. Во-вторых, скорость подключения. Встречается ситуация, когда из-за повреждённого кабеля или порта коммутатора сервер работает на 100 Мбит/с вместо 1 Гбит/с. Внешне всё «работает», но при одновременной работе нескольких сотрудников с файлами и 1С сеть быстро упирается в потолок.
Показатели и ориентиры в одной таблице
| Ресурс и показатель | Нормально | Тревожный сигнал | Частая причина |
|---|---|---|---|
| CPU — загрузка | Пики до 100%, потом спад | 80–90%+ десятки минут в рабочее время | Тяжёлые отчёты и регламентные задания 1С, антивирус, нехватка ядер |
| CPU — очередь процессора | До 2 на ядро | Стабильно больше 2 на ядро | Ресурсов процессора не хватает на текущую нагрузку |
| Память — доступный объём | Свободно больше 10% | Меньше 10%, активен файл подкачки | SQL Server без ограничения памяти, рост числа пользователей и баз |
| Диск — время отклика (HDD) | До 10 мс | Стабильно выше 20–25 мс | Медленные диски, бэкап или антивирус в рабочее время, деградированный RAID |
| Диск — время отклика (SSD) | Около 1–2 мс | 5–10 мс и выше | Износ SSD, перегруженный контроллер, общий диск на несколько виртуальных машин |
| Сеть — загрузка и скорость порта | До 50–60%, порт 1 Гбит/с | 70%+ постоянно или порт на 100 Мбит/с | Повреждённый кабель или порт, копирование больших файлов в рабочее время |
Значения — рабочие ориентиры, а не жёсткие нормы: многое зависит от конфигурации сервера и того, какие задачи на нём работают.
Где смотреть эти показатели на Windows Server
Для первичной проверки не нужны сторонние программы — всё есть в самой Windows:
- Диспетчер задач — быстро показывает общую загрузку CPU, памяти, диска и сети. Годится, чтобы понять, какой ресурс вообще на пределе.
- Монитор ресурсов (команда
resmon) — показывает, какой именно процесс нагружает диск и к каким файлам обращается, а также время отклика по каждому диску. Это главный инструмент, чтобы найти виновника. - Системный монитор (команда
perfmon) — позволяет записывать показатели в течение всего рабочего дня. Это важно, когда жалобы появляются эпизодически: запись за день покажет, в какое время и на каком ресурсе начинается перегрузка. - Журнал событий — ошибки дисков, RAID-контроллера и служб часто объясняют, почему сервер вдруг стал медленным.
Кто на самом деле нагружает сервер
Когда ресурс-узкое место найдено, следующий вопрос — что его занимает. На практике виновник часто не связан с работой пользователей:
- Резервное копирование, которое запускается в рабочее время и забирает диск и сеть. Как правильно выстроить бэкапы, разобрано в чек-листе по резервным копиям
- Антивирус, который проверяет в реальном времени файлы баз 1С и SQL Server при каждом обращении к ним
- Регламентные задания 1С, пересчёт итогов и тяжёлые отчёты в разгар рабочего дня (подробнее — в статье «1С зависает при формировании отчёта»)
- Установка обновлений Windows или индексация файлов на сервере в рабочие часы
- Файловая база 1С, из которой выросли: при большом числе пользователей она сильно нагружает диск и сеть. Когда пора переходить на клиент-серверный вариант, разобрано в статье «Файловая или серверная версия 1С»
Отдельный случай — резкая и необъяснимая активность диска, которой раньше не было, особенно массовая запись в общие папки. Это один из признаков работы вируса-шифровальщика. Здесь не нужно разбираться с производительностью: сервер нужно как можно скорее отключить от сети и вызвать специалиста. О том, как снизить такой риск заранее, — в статье о защите от шифровальщика на уровне сети.
Если сервер виртуальный
Во многих офисах 1С, файловое хранилище и контроллер домена работают как виртуальные машины на одном физическом сервере (Hyper-V или VMware). Здесь есть ловушка: внутри виртуальной машины загрузка может выглядеть умеренной, а тормозит всё потому, что перегружен сам физический сервер (хост) или его общий диск.
Поэтому показатели нужно смотреть на двух уровнях: внутри виртуальной машины и на хосте. Типичные причины — виртуальным машинам суммарно выделено больше процессоров и памяти, чем есть физически, или несколько машин одновременно нагружают один дисковый массив, например бэкап одной машины идёт в то время, когда на соседней работают с 1С.
Чек-лист первичной проверки
Если сервер тормозит у всех, пройдите по списку в момент жалоб:
- Загрузка CPU держится высокой постоянно или это короткие пики?
- Сколько свободной памяти осталось и не используется ли активно файл подкачки?
- Какое время отклика дисков в мониторе ресурсов (resmon)?
- Какой процесс создаёт основную нагрузку на перегруженный ресурс?
- Не совпадает ли время торможения с бэкапом, обновлениями или регламентными заданиями?
- На какой скорости подключён сетевой порт сервера — 1 Гбит/с или 100 Мбит/с?
- Нет ли в журнале событий ошибок дисков и RAID-контроллера?
- Если сервер виртуальный — как чувствует себя физический хост?
Пример (условная ситуация, не описание конкретного клиента). В офисе на 20 человек 1С каждое утро заметно тормозила у всех с 10 до 12 часов. Руководитель уже готовился покупать новый сервер: «старый не тянет». В диспетчере задач процессор был загружен примерно на треть, свободной памяти хватало. Монитор ресурсов показал другое: время отклика диска с базами доходило до десятков миллисекунд, а основную нагрузку создавал процесс антивируса. Он проверял файлы базы при каждом обращении к ним. После того как папки с базами и служебные файлы 1С и SQL Server добавили в исключения антивируса, время отклика вернулось в норму. Покупка нового сервера не понадобилась.
Что делать дальше: настройка, апгрейд или замена
Перегрузку можно устранить тремя путями, и начинать стоит с самого дешёвого:
- Настройка. Перенести бэкапы и регламентные задания на ночь, настроить исключения антивируса, ограничить память SQL Server, заменить кабель или порт коммутатора. Это часто решает проблему без затрат на оборудование.
- Апгрейд. Если узкое место одно и понятно какое — добавить память или перевести базы на SSD. На исправной и не слишком старой платформе это заметно дешевле нового сервера.
- Замена. Если нехватка ресурсов накладывается на возраст, истёкшую гарантию и сбои железа. Как принять это решение, разобрано в статье «Как понять, что сервер в офисе пора менять».
Если причина не находится за полчаса или на сервере работает сразу несколько ролей и виртуальных машин, лучше не гадать. Специалист снимет показатели за полный рабочий день и найдёт конкретную причину. BSSystems проводит бесплатный аудит ИТ-инфраструктуры в Санкт-Петербурге, включая проверку сервера. Обслуживание серверов тарифицируется отдельно от рабочих мест и обсуждается индивидуально — подробнее в разделе услуг по серверам и 1С.
Частые вопросы
Если медленно работают все, кто подключён к серверу, и примерно в одно время, — это почти всегда сервер или сеть. Если тормозит один компьютер, а у соседей всё нормально, проблема на рабочем месте.
Не обязательно. Короткие пики до 100% — нормальная работа. О перегрузке говорит загрузка 80–90% и выше, которая держится десятки минут в обычные рабочие часы, а также длинная очередь процессора.
Да, по умолчанию SQL Server забирает свободную память под кэш. Проблемой это становится, когда памяти не хватает системе и сервису 1С. Тогда в настройках SQL Server ограничивают максимальный объём памяти.
Время отклика — сколько миллисекунд занимает одна операция чтения или записи. Процент загрузки в диспетчере задач мало о чём говорит. Время отклика видно в мониторе ресурсов (resmon) и системном мониторе (perfmon).
Чаще нет. Перегрузку нередко устраняет настройка: перенос бэкапов на ночь, исключения антивируса, ограничение памяти SQL Server. Апгрейд или замена нужны, когда узкое место остаётся после настройки или сервер уже устарел.