Внутренняя панель состояния сервисов · доступ из корпоративной сетиОбновлено: 20 августа 2026, 09:40 (MSK)
Обходчик
состояние сервисов
История инцидентов
В журнал попадают все перерывы дольше минуты и все согласованные окна
обслуживания. Запись закрывается только после разбора: указываем причину, хронологию
и то, что сделано, чтобы случай не повторился.
Записи за последние 12 месяцев хранятся на этой странице, более ранние —
в архиве группы сопровождения, выдаются по запросу владельца системы.
За год число инцидентов снизилось с шести до трёх-четырёх в месяц,
среднее время восстановления — с 78 до 36 минут.
Записи журнала
новые сверху
Складской учёт: недоступность 26 минут
12 августа 2026, 14:12–14:38
Переполнение журнала транзакций на основном узле базы данных. Записи о приёмке не сохранялись, интерфейс отвечал ошибкой сохранения. Данные не потеряны: все операции восстановлены из очереди после переключения на резервный узел.
14:12 — автоматическая проверка зафиксировала рост ошибок записи
14:26 — переключение на резервный узел, приём операций возобновлён
14:38 — очередь разобрана, показатели вернулись к норме
16:40 — журнал перенесён на отдельный том, порог свободного места поднят
Класс A · время реакции 5 мин · восстановление 26 мин · цель по классу — 60 мин
Печать и МФУ: деградация 2 часа 10 минут
4 августа 2026, 09:05–11:15
Очередь печати на филиальном сервере обрабатывалась с задержкой до восьми минут. Причина — единовременная отправка большого пакета документов из отчётного контура. Печать не прерывалась, но задания выполнялись медленно.
09:05 — рост времени ожидания задания выше порога
09:20 — инцидент открыт, приоритет П3
10:10 — крупные задания перенесены в отдельную очередь
11:15 — время ожидания вернулось к обычным 20 секундам
Класс B · время реакции 15 мин · восстановление 130 мин · цель по классу — 240 мин
Единый вход: перерыв 8 минут
27 июля 2026, 03:02–03:10
Плановая ротация ключей подписи затянулась: новый ключ раздался не на все узлы сразу. Часть сессий потребовала повторного входа. Работы выполнялись в согласованном окне, обращений от пользователей не поступало.
03:02 — начата ротация ключей по регламенту
03:06 — два узла отвечали старым ключом, вход прерывался
Класс A · работы в окне · фактический перерыв 8 мин
Шина обмена данными: 41 минута
15 июля 2026, 21:33–22:14
Отказ дискового массива на узле очередей. Обмен между кадровым контуром и отчётностью остановился, сообщения накапливались в буфере отправителя. После замены диска очередь разобрана автоматически, потерь сообщений нет.
21:33 — узел очередей перестал принимать соединения
21:41 — инцидент подтверждён, приоритет П1
22:02 — диск заменён из холодного резерва, узел поднят
22:14 — накопленные 18 400 сообщений доставлены
Класс A · время реакции 8 мин · восстановление 41 мин
Отчётность и витрины: плановые работы
21 августа 2026, 22:00–01:00
Перевод витрин на новую схему хранения. В окне работ отчёты формироваться не будут, выгрузки за прошлые периоды останутся доступными в файловом хранилище. Отдельного согласования не требуется — работы попадают в регулярное окно.
Класс B · плановое окно · уведомление разослано 14 августа
Что считается инцидентом
чтобы журнал был сопоставим
Инцидент — незапланированное отклонение, при котором контрольный сценарий не
выполняется или не укладывается в норматив дольше минуты. Единичная неудачная
проверка инцидентом не считается: она может быть вызвана обрывом на стороне
самой платформы наблюдения.
Приоритеты
П1 — сервис класса A недоступен для всех пользователей;
П2 — сервис класса A работает с потерей функций или для части подразделений;
П3 — деградация сервисов классов B и C;
П4 — единичные обращения, обходной путь есть.
Приоритет присваивает дежурная смена в момент подтверждения и может повысить
его по ходу разбора. Понижение согласуется с владельцем системы.