IncidentGarden

Словарь терминов

Термины Incident Garden — системное имя (как в интерфейсе) и русское название для текстов, с коротким определением.

Этот словарь фиксирует, какими терминами оперирует Incident Garden. У каждого термина два имени: системное (английское — так он называется в интерфейсе) и русское (как мы говорим о нём в текстах документации). Формат записи: English (русское) — определение.

Если встретили незнакомое слово в другом разделе — ищите его здесь.

Обработка алертов

  • Alert (алерт) — единица инцидента: сигнал от системы мониторинга, который прошёл конвейер обработки и требует внимания. Живёт по циклу firingacknowledgedresolved; дополнительно может быть на паузе (delayed, silenced) или отброшен (dropped).
  • Severity (важность) — уровень важности алерта. Всего два значения: critical и warning. От важности зависит, насколько настойчивой будет эскалация.
  • Severity mapping (маппинг важности) — правило интеграции, которое переводит «родные» уровни источника (например, у Zabbix — disaster, high) в нашу важность critical или warning.
  • Integration (интеграция) — точка приёма сигналов от источника мониторинга по API-ключу. Задаёт команду-владельца, маршрут оповещения и правила определения важности.
  • Label (метка) — пара «ключ = значение» из сигнала. Метки — это то, по чему работают условия политик и сайленсов.
  • Policy (политика обработки, в тексте — политика) — правило обработки алерта на конвейере: отбросить, отложить, заглушить, поднять или снизить важность, дополнить метками. Принадлежит команде. Полное системное имя — Integration Policy.
  • Silence (сайленс) — ручное временное подавление алертов под конкретную ситуацию: плановые работы или известная проблема. Заводится вручную на ограниченный срок и выключается само.

Дежурства и оповещение

  • Team (команда) — группа, которая владеет интеграциями, расписаниями и политиками и принимает алерты.
  • Schedule (расписание) — расписание дежурств команды. Отвечает на вопрос «кто on-call прямо сейчас».
  • Rotation (ротация) — циклическая смена дежурных внутри расписания: участники заступают на дежурство по очереди, по кругу.
  • Override (оверрайд) — временная замена дежурного на заданный период поверх ротаций.
  • Escalation Policy (политика эскалации) — цепочка шагов оповещения по активному алерту: кого и через сколько минут звать, пока инцидент не подтвердят.
  • Step (шаг) — звено политики эскалации: цель (расписание, пользователь или команда) и время активации, отсчитываемое от старта эскалации.
  • Escalation (эскалация) — прохождение алерта по шагам политики эскалации, пока его не подтвердят или цепочка не исчерпается.
  • Notification channel (канал уведомлений) — способ доставки оповещений конкретному пользователю: email, Telegram, голосовой звонок.
  • Notification rule (правило уведомлений) — связка «важность алерта → каким каналом и с какой задержкой оповестить»; задаётся раздельно для critical и warning.
  • Voice Call (голосовой звонок) — канал доставки звонком на номер в формате +7…; подтверждение запускается вручную, звонок зачитывает код.

Организация и доступ

  • Organization (организация) — верхний контейнер всех данных: команд, расписаний, интеграций, политик и алертов.
  • Owner (владелец) — роль уровня организации: полный доступ ко всему; единственный в организации.
  • Org Admin (администратор организации) — роль уровня организации: приглашения, состав организации (роли, должности, исключение участников) и её настройки; по умолчанию доступ ко всем командам.
  • Org Member (участник организации) — базовая роль уровня организации: работа в тех командах, где состоит.
  • Team Admin (администратор команды) — роль уровня команды: настройка команды, её интеграций, расписаний, политик эскалации и политик обработки.
  • Team Member (участник команды) — роль уровня команды: участие в дежурствах, получение алертов и оперативные инструменты (сайленсы, оверрайды).
  • Position (должность) — информационный справочник «кто есть кто». На доступ не влияет — права определяют только роли.

На этой странице