При каких значениях 1С действительно тормозит: пороги, по которым мы смотрим кластеры
«1С тормозит» — самая частая и самая бесполезная формулировка в заявке. Тормозит у всех и всегда; вопрос в том, где именно теряется время: на сервере приложений, в СУБД, на блокировках или в самой конфигурации. Ниже — значения, по которым мы смотрим кластеры, которые обслуживаем, и три причины, по которым типовые шаблоны мониторинга шумят вместо того, чтобы помогать.
Времена отклика
**Время вызова сервера.** До 1 с — норма, 1–3 с — внимание, больше 3 с — критично. Считать нужно 95-й перцентиль за 5 минут, а не среднее. Если 95% операций проходят за 0,2 с, а оставшиеся 5% — за 8 с, среднее покажет приличную цифру, а бухгалтерия всё равно будет стоять. Среднее прячет ровно то, на что жалуются люди.
**Время обращения к СУБД.** До 0,5 с — норма, 0,5–2 с — внимание, больше 2 с — критично. Здесь тот же перцентиль. Рост этого показателя при нормальном времени вызова сервера обычно указывает на диски, устаревшую статистику или планы запросов, а не на сам кластер.
**Доступная производительность.** Выше 80% от целевого значения операции — норма, 60–80% — внимание, ниже 60% — работать некомфортно, пользователи это чувствуют. Важная оговорка: сравнивать нужно с базовым уровнем конкретной базы, а не с абстрактным эталоном. У бухгалтерской базы на сорок человек и у розничной на четыреста нормальные значения разные.
Блокировки
**Ожидания на управляемых блокировках.** Меньше 1% от общего времени вызовов — норма, 1–5% — внимание, больше 5% — критично.
Это тот показатель, который чаще всего объясняет жалобы вида «в обед невозможно провести документ»: сервер свободен, СУБД отвечает быстро, а пользователи стоят в очереди друг за другом. Без отдельного измерения ожиданий такая ситуация выглядит как «всё в норме, но работать нельзя».
Ресурсы рабочих процессов
**Память rphost.** Считать следует не потребление оперативной памяти сервера, а отношение памяти процесса к установленному для него лимиту. До 70% лимита — норма, 70–90% — внимание, выше 90% — критично: процесс скоро перезапустится и утянет за собой сеансы.
**Загрузка процессора рабочими процессами.** До 70% — норма, 70–85% — внимание, выше 85% — критично. Но только при устойчивом превышении: 5 минут подряд, а не единичный всплеск. Иначе обычное проведение большого документа будет выглядеть как авария.
Нагрузка и очереди
**Клиентские лицензии.** Занято меньше 80% — норма, 80–95% — внимание, выше — критично. Но процентов недостаточно: 95% при двадцати лицензиях и при пятистах — разные ситуации. Нужен абсолютный порог тоже: осталось две лицензии или меньше — предупреждать независимо от процента.
**Активные сеансы.** Смотреть не абсолютное число, а долю от обычного максимума для этого часа этого дня недели. До 80% — норма, 80–100% — внимание, выше 100% — критично. Профиль нагрузки у учётных баз жёстко привязан к календарю: понедельник не похож на пятницу, а день закрытия месяца не похож ни на что. Сравнение с «нормой вообще» превращает закрытие месяца в аварию, а тихий вторник при реальном сбое — в норму.
**Фоновые задания в очереди.** 0–5 одновременно — норма, 6–20 — внимание, больше 20 — критично: задания начали накапливаться быстрее, чем выполняются.
Почему типовые шаблоны шумят
Три причины повторяются из установки в установку.
Времена считают средним вместо перцентиля — и реальная проблема остаётся невидимой за приличной средней цифрой.
Сеансы и производительность сравнивают с фиксированным числом вместо базового уровня конкретной базы — и мониторинг кричит в каждый пиковый день, хотя ничего не сломалось.
Пороги ставят без гистерезиса, то есть без разных значений для срабатывания и снятия. Показатель у границы заставляет алерт звенеть: поднялся, упал, снова поднялся. После пятого раза его перестают читать — а это худшее состояние мониторинга из возможных.
Как мы это собираем
Все перечисленные показатели снимаются через штатную службу администрирования кластера (RAS): без расширений, без изменений в конфигурациях и без доработок информационных баз. Подробнее — на странице мониторинга 1С, а как выглядят сами дашборды, можно посмотреть в живом демо без регистрации.
Проверим ваш кластер за три дня
Не уверены, где именно теряется время? Мы ставим агент одной командой, три дня собираем показатели вашего кластера и присылаем разбор: сервер, СУБД, блокировки или конфигурация. Не подойдёт — агент удаляется одной командой.
Написать: @ivan_vodinskiy или оставить заявку.