Причина одного или нескольких инцидентов.
Что это значит на практике
Инцидент и проблема — разные объекты с разными целями и сроками. Инцидент требует восстановить работу как можно быстрее, проблема — найти и устранить причину, и времени это занимает больше. Держать их в одном потоке значит испортить обе метрики.
Проблема и инцидент: в чём разница
Инцидент — незапланированное прерывание услуги или снижение её качества. Проблема — причина одного или нескольких инцидентов.
Цели у них разные, и сроки тоже. Инцидент требует восстановить работу как можно быстрее, проблема — найти и устранить причину, а на это уходит больше времени. Держать их в одном потоке значит испортить обе метрики: инциденты будут висеть, пока ищут причину, а проблемы закрываться, как только полегчало.
В жизни это выглядит так: касса упала в третий раз за неделю — три инцидента и одна проблема. Инциденты закрыты перезапуском, проблема не начата.
Что ещё путают с проблемой
Три пары, и разница в каждой определяет, кто берётся за работу:
- проблема и известная ошибка: известная ошибка — это проблема, у которой уже установлена причина или найден обходной путь;
- проблема и запрос на изменение: если система работает так, как спроектирована, а спроектирована неудачно, это не проблема, а требование на изменение;
- проблема и риск: риск — то, что может случиться; проблема — то, что уже проявилось инцидентами.
Известные ошибки и обходные решения
Реестр известных ошибок — самый недооценённый результат практики. Он же единственное, чем практика управления проблемами напрямую помогает первой линии сегодня, а не через квартал.
Запись содержит признаки, по которым ошибку узнают, перечень инцидентов, которые она порождает, и обходной путь.
Заводится она рано: как только диагностика продвинулась достаточно, чтобы понимать, в чём дело, — даже если причина ещё не устранена. Ждать окончательного решения незачем, обходной путь нужен уже сейчас.
Что портит реестр. Первое и главное — записи без признаков: причина описана, а узнать её в новом обращении не по чему. Такая запись бесполезна тому, ради кого реестр и ведётся.
Реактивная работа и проактивная
Реактивная — от случившихся инцидентов: повторяется, значит есть причина, ищем.
Проактивная — от данных: разбор тенденций, слабых мест, повторяющихся обращений до того, как они сложились в крупный сбой.
Вторая почти всегда проигрывает первой в очереди за вниманием, потому что не горит. Организации, где проактивной работой занимаются, обычно выделяют под неё отдельное время и отдельного человека — иначе она не случается никогда.
Как это выглядит в жизни
Один и тот же сбой каждый понедельник
Утром понедельника заявки идут пачкой: не открывается складская система. Каждый инцидент закрывают перезапуском, к обеду всё работает. Инциденты закрыты, а причина живёт: за выходные копится очередь заданий, которую никто не чистит. Разбираться с этим — работа по проблеме, а не по инциденту.
Проблему заводят и на один инцидент
Ночью встал обмен с банком. Инцидент один и восстановлен вручную за час. Но если не понять, почему обмен встал, следующей ночью повторится то же самое. Повторяемость — не обязательное условие: важна цена того, что причина неизвестна.
Два случая, которые путают
Работа по проблеме
- Цель — вернуть работу
- Счёт идёт на минуты
- Обходной путь годится
- Закрывается восстановлением
Работа по инциденту
- Цель — убрать причину
- Счёт идёт на недели
- Обходной путь не годится как итог
- Закрывается устранением
Чем отличается от известной ошибки
Пока причина неизвестна — это проблема в работе. Как только причина установлена и найден обходной путь, появляется известная ошибка: запись, по которой следующий такой же инцидент закрывают без расследования. Проблема при этом может остаться открытой — до исправления, которого ждут от поставщика.
Разбор соседнего термина — известная ошибка.
Где встречается
Практики справочника, рядом с которыми живёт этот термин:
Своды знаний, в которых этот термин определён:
Что с этим делать здесь
Откуда термин
ITIL. Формулировка на этой странице своя.