Введение
Документация Incident Garden — как начать и где искать ответы.
Incident Garden — это российская платформа для управления инцидентами и дежурствами on-call: алерты приходят из ваших систем мониторинга, попадают к нужным людям по цепочкам эскалации, а команда видит общую картину в одном интерфейсе.
Документация сгруппирована по трём задачам: начать работу, понять модель продукта и свериться со справочником.
Начало
Quick Start — линейный сценарий «настрой за пять минут». Регистрация, создание команды, расписание дежурств, политика эскалации, подключение интеграции и первый алерт. Если вы впервые открываете Incident Garden, начните отсюда.
Начало работы — фундамент: как устроены организации, роли и доступ, участники и должности. Если хотите понять модель продукта целиком, а не просто пройти happy-path, начните отсюда.
Интеграции — точечные рецепты под конкретную задачу: подключить AlertManager, Zabbix или обобщённый webhook, настроить маппинг важности. Сюда заходят за готовым ответом, когда база уже настроена.
Возможности
Расписания — кто дежурит и когда: ротации по кругу, участники, оверрайды на конкретные даты. Система всегда знает, кто on-call, и отдаёт этого человека эскалации.
Политики эскалации — цепочки оповещения по активному алерту: кого и через сколько минут от старта звать, если инцидент ещё не подтверждён. Маршрут (какая команда и политика) задаёт интеграция.
Политики — правила обработки входящих алертов: отсеять шум, поднять или снизить важность, придержать или отбросить сигнал до того, как сработает эскалация. Здесь же — готовые пресеты под типовые сценарии.
Сайленсы — ручное временное подавление алертов на период плановых работ или известной проблемы: точечно по меткам, на заданный срок, с автоматическим возвратом в работу по истечении окна.
Уведомления — личные каналы доставки (email, Telegram, голосовой звонок) и правила маршрутизации по важности: какими каналами, в каком порядке и с какой задержкой дотянуться лично до вас.
Понимание
Концепции — как продукт устроен внутри: почему важностей всего две, как маппинг переводит уровни источника в нашу модель и как ведёт себя эскалация. Не «куда нажать», а «почему именно так».
Anti-Patterns — типичные ошибки при настройке алертинга и дежурств, которые обесценивают любую систему мониторинга. Полезно прочитать после Quick Start, чтобы сразу избежать ловушек.
Сравнение с альтернативами — карта различий между Incident Garden и OpsGenie, Grafana OnCall, PagerDuty. Если вы уже работали с одной из этих систем, этот раздел поможет быстро понять, как соотносится наша модель с тем, что вы знаете. Это не выбор «лучше / хуже» — только описание архитектурных и терминологических различий.
Справка
Справочник — точные форматы и значения: тело запроса для приёма алертов, допустимые поля. Сюда заходят, чтобы свериться с конкретной деталью.
Документация развивается вместе с продуктом: разделы будут пополняться по мере появления новых сценариев. Если что-то непонятно или вы хотите рассказать о собственном опыте — напишите нам через канал поддержки.