Шаникс
База знаний 5 минут чтения

Что такое инцидент в IT:
сбой, который нужно устранить

Инцидент — это любое незапланированное событие, которое мешает пользователю нормально работать. Не путайте с запросом на обслуживание.

Определение

Инцидент (Incident) — это незапланированное прерывание или снижение качества IT-услуги. Проще говоря: что-то сломалось или работает хуже, чем должно.

Примеры: не загружается CRM, не печатает принтер, почта не отправляется, VPN-соединение обрывается. Каждый такой случай — инцидент, который фиксируется как тикет в Help Desk.

Инцидент

Что-то сломалось → нужно починить как можно быстрее. Цель — восстановить работу.

Запрос на обслуживание

Ничего не сломано → пользователь хочет что-то новое: доступ, программу, оборудование.

Инцидент, проблема, запрос — в чём разница?

В ITSM эти понятия строго разделены:

  • Инцидент — сбой, который нужно устранить прямо сейчас («не работает 1С»).
  • Проблема — корневая причина повторяющихся инцидентов («1С падает каждую пятницу из-за нагрузки на сервер»).
  • Запрос — плановое обращение, не связанное со сбоем («установите мне AutoCAD»).

Приоритеты инцидентов

Не все инциденты одинаково срочные. Обычно используют 4 уровня:

P1 Критический. Сервис полностью недоступен. Реакция — 15 минут, решение — 1–2 часа.
P2 Высокий. Сервис работает с серьёзными ограничениями. Реакция — 30 минут, решение — 4 часа.
P3 Средний. Неудобно, но работать можно. Реакция — 2 часа, решение — 8 часов.
P4 Низкий. Косметическая неисправность. Решение — до 3 рабочих дней.

Сроки реакции и решения для каждого приоритета фиксируются в SLA. Система отслеживает их автоматически.

Как правильно управлять инцидентами

1

Регистрация

Каждый инцидент фиксируется как тикет. Никаких «просто заходи, посмотрю» без записи.

2

Классификация

Тип (инцидент / запрос), категория (сеть / ПО / оборудование), приоритет (P1–P4).

3

Диагностика и решение

Специалист анализирует проблему. Если есть статья в базе знаний — применяет готовое решение.

4

Эскалация (при необходимости)

Если первая линия не справляется — передача специалисту выше. SLA-таймер продолжает тикать.

5

Закрытие и анализ

Пользователь подтверждает решение. Данные попадают в отчёты. Повторяющиеся инциденты → анализ корневой причины.

Ошибки

Не регистрировать инциденты. «Я просто перезагрузил сервер» — а через неделю он упадёт снова, и никто не вспомнит почему.
Всё называть критическим. Если каждый инцидент P1 — значит ни один не P1. Приоритизация теряет смысл.
Не искать корневую причину. Устранять симптом раз за разом вместо того, чтобы решить проблему.

Часто задаваемые вопросы

Инцидент и авария — одно и то же? +

Авария (Major Incident) — это инцидент высшей степени: массовый сбой, затрагивающий многих пользователей. Обычный инцидент может касаться одного человека.

Кто решает инциденты? +

Первая линия поддержки (оператор/диспетчер). Если не хватает компетенций — вторая линия (инженер). Для критичных случаев — третья линия (разработчик/архитектор).

Как считается время решения инцидента? +

С момента регистрации тикета до подтверждения пользователем, что проблема решена. В Шаникс таймер учитывает рабочие часы и паузы на ожидание ответа.

Что делать с повторяющимися инцидентами? +

Превратить в «проблему» и искать корневую причину. Если принтер ломается каждую неделю — нужно менять принтер, а не чинить его снова.

Управление инцидентами в Шаникс

Автоматическая регистрация, приоритизация, SLA-таймеры и эскалация. Всё для того, чтобы сбои решались быстро.

Попробовать бесплатно