IncidentGarden

Введение

Документация Incident Garden — как начать и где искать ответы.

Incident Garden — это российская платформа для управления инцидентами и дежурствами on-call: алерты приходят из ваших систем мониторинга, попадают к нужным людям по цепочкам эскалации, а команда видит общую картину в одном интерфейсе.

Документация сгруппирована по трём задачам: начать работу, понять модель продукта и свериться со справочником.

Начало

Quick Start — линейный сценарий «настрой за пять минут». Регистрация, создание команды, расписание дежурств, политика эскалации, подключение интеграции и первый алерт. Если вы впервые открываете Incident Garden, начните отсюда.

Начало работы — фундамент: как устроены организации, роли и доступ, участники и должности. Если хотите понять модель продукта целиком, а не просто пройти happy-path, начните отсюда.

Интеграции — точечные рецепты под конкретную задачу: подключить AlertManager, Zabbix или обобщённый webhook, настроить маппинг важности. Сюда заходят за готовым ответом, когда база уже настроена.

Возможности

Расписания — кто дежурит и когда: ротации по кругу, участники, оверрайды на конкретные даты. Система всегда знает, кто on-call, и отдаёт этого человека эскалации.

Политики эскалации — цепочки оповещения по активному алерту: кого и через сколько минут от старта звать, если инцидент ещё не подтверждён. Маршрут (какая команда и политика) задаёт интеграция.

Политики — правила обработки входящих алертов: отсеять шум, поднять или снизить важность, придержать или отбросить сигнал до того, как сработает эскалация. Здесь же — готовые пресеты под типовые сценарии.

Сайленсы — ручное временное подавление алертов на период плановых работ или известной проблемы: точечно по меткам, на заданный срок, с автоматическим возвратом в работу по истечении окна.

Уведомления — личные каналы доставки (email, Telegram, голосовой звонок) и правила маршрутизации по важности: какими каналами, в каком порядке и с какой задержкой дотянуться лично до вас.

Понимание

Концепции — как продукт устроен внутри: почему важностей всего две, как маппинг переводит уровни источника в нашу модель и как ведёт себя эскалация. Не «куда нажать», а «почему именно так».

Anti-Patterns — типичные ошибки при настройке алертинга и дежурств, которые обесценивают любую систему мониторинга. Полезно прочитать после Quick Start, чтобы сразу избежать ловушек.

Сравнение с альтернативами — карта различий между Incident Garden и OpsGenie, Grafana OnCall, PagerDuty. Если вы уже работали с одной из этих систем, этот раздел поможет быстро понять, как соотносится наша модель с тем, что вы знаете. Это не выбор «лучше / хуже» — только описание архитектурных и терминологических различий.

Справка

Справочник — точные форматы и значения: тело запроса для приёма алертов, допустимые поля. Сюда заходят, чтобы свериться с конкретной деталью.

Документация развивается вместе с продуктом: разделы будут пополняться по мере появления новых сценариев. Если что-то непонятно или вы хотите рассказать о собственном опыте — напишите нам через канал поддержки.

На этой странице