[Документация Yandex Cloud](../../../index.md) > [Monium](../../index.md) > Алерты > Пошаговые инструкции > Создание алерта SLO

# Создание SLO-алерта

SLO-алерты помогают контролировать надежность сервиса относительно целевого [SLO](../../slo/index.md). Они строятся на выбранном SLO и его вычисленных показателях: [Error Budget](../../slo/index.md#basic-terms) и Burn Rate. Используйте такие алерты, чтобы вовремя заметить риск нарушения SLO и оценить влияние инцидента на пользовательский сценарий.

Перед созданием SLO-алерта [создайте и настройте SLO](../../slo/management.md#config).

{% note info %}

Для просмотра [алертов](../../concepts/alerting/alert.md) необходима роль `viewer` или выше на облако. Подробнее о ролях в разделе [Управление доступом в Monium](../../security/index.md).

{% endnote %}

{% list tabs group=instructions %}

- Интерфейс Monium {#console}

  1. На главной странице [Monium](https://kz.monium.yandex.cloud) слева выберите ![alt](../../../_assets/console-icons/shield-exclamation.svg) **Алерты и SLO** → ![alt](../../../_assets/console-icons/megaphone.svg) **Алерты**.
  1. Вверху справа нажмите **Создать алерт** → **SLO**.
  1. Укажите основные параметры алерта:

      * **Название** — произвольное название алерта.
      * **ID** — уникальный идентификатор алерта с префиксом проекта. По умолчанию совпадает с названием.
      * **Описание** — назначение алерта или комментарий.
      * **Уровень алерта** — [уровень критичности алерта](../../concepts/alerting/alert.md#severity). Выбирайте уровень по влиянию события:
      
          * `Unspecified` — черновик или тест без выбранного уровня.
          * `Disaster` — недоступность сервиса или риск потери данных.
          * `Critical` — деградация сервиса или нехватка ресурсов.
          * `Info` — плановая операция или тестовый алерт.

  1. В поле **Тип** выберите:

      * **Error Budget** — контролирует запас бюджета ошибок. Подходит для планирования релизов и оценки риска нарушить SLO.
      * **Burn Rate** — контролирует скорость расхода бюджета ошибок. Подходит для дежурства и быстрого обнаружения инцидентов.

      Для критичных SLO создайте алерты обоих типов. **Error Budget** показывает, сколько бюджета осталось, а **Burn Rate** — как быстро он расходуется.

  1. В блоке **Настройки алерта** выберите проект и SLO, для которого создаете алерт.
  1. В блоке **Условия срабатывания** настройте параметры, при которых будет изменяться статус алерта.

      Для **Error Budget**:

      * **Метод расчета** — выберите способ контроля `Error Budget`:
        * **Остаток Error Budget** — срабатывает, когда остаток бюджета ниже порога. В **Warning** и **Alarm** задайте минимальный допустимый остаток. Например, `20`% можно использовать для раннего предупреждения, а `10`% — для критичного риска исчерпания бюджета.
        * **Скорость расхода Error Budget** — срабатывает, когда расход превышает порог за **Окно вычисления**. Используйте метод для инцидентов, которые быстро расходуют бюджет, например массовых ошибок авторизации после релиза.

      Для **Burn Rate**:

      * **Warning** — укажите порог для предупреждения. Значение `0,5` означает, что `Error Budget` расходуется со скоростью 50% от предельной.
      * **Alarm** — укажите порог для критичного статуса. Значение `1` означает, что `Error Budget` расходуется с предельной скоростью: если такой расход сохранится, бюджет будет исчерпан к концу окна SLO.
      * **Длинное окно** — задайте основное окно проверки для расчета скорости расхода `Error Budget`. Используйте его для оценки устойчивого ухудшения SLO, например роста доли ошибок за последний час.
      * **Короткое окно** — задайте дополнительное короткое окно для быстрого снижения статуса. Если `Error Budget` перестал расходоваться, короткое окно быстрее заметит восстановление и переведет алерт в менее критичный статус.
      * **Включить дополнительную проверку расхода бюджета ошибок** — включите, чтобы алерт срабатывал только при высокой скорости расхода и значимой доле уже потраченного `Error Budget`. Это снижает риск ложных срабатываний при проблеме малого трафика (low traffic problem): когда событий мало, доля ошибок может расти, но фактический расход бюджета остается низким.
      * **Окно вычисления** — задайте период, за который проверяется условие. Для быстрых пользовательских сценариев выбирайте короткое окно, для фоновых задач — более длинное.

  1. Настройте [прореживание данных](../../concepts/alerting/alert.md#decimation) или оставьте значения по умолчанию. Для алертов по пиковым значениям выбирайте `Максимум`, для счетчиков — `Сумма` или `Количество`. Если метрика состояния меняется редко, в поле **Заполнение** выберите **Предыдущее значение**.
  1. Задайте [политики обработки отсутствия данных](../../concepts/alerting/alert.md#no-data-policy) или оставьте значения по умолчанию. Для критичных SLO выбирайте статус `No data`, чтобы отличать сбой сбора метрик от выполнения SLO. Если отдельные инстансы могут исчезать при автомасштабировании, используйте упрощенное применение политик.

  1. (Опционально) Укажите [аннотации](../../concepts/alerting/annotation.md) к алерту.
  1. (Опционально) Для сортировки и поиска алертов добавьте лейблы в формате `ключ=значение`.

      Можно добавить несколько лейблов. Для этого после ввода пары `ключ=значение` нажмите клавишу **Enter**. Чтобы использовать лейблы в другом алерте или в строке поиска, нажмите кнопку **Скопировать все лейблы**.

  1. (Опционально) В блоке **Ссылки** добавьте ссылки на связанные ресурсы.
  1. Настройте [уведомления](../../concepts/alerting/notification-channel.md). Если у вас нет канала уведомлений, [создайте его](create-channel.md).

      Чтобы не получать уведомление при каждой смене статуса, включите **Подавление шума**. Используйте настройку для SLO с низким трафиком, когда статус может кратковременно меняться из-за небольшого числа событий. Подробнее о подавлении шума в разделе [Подавление шума](../../concepts/alerting/alert.md#noise-suppression).

  1. Проверьте результат вычисления алерта.

      Вверху справа нажмите **Проверить результат**. Monium пересчитает алерт по текущим настройкам и покажет вычисленный статус, график и значения переменных.
      
      Используйте проверку, чтобы убедиться, что запросы возвращают данные, а пороги и политики отсутствия данных работают, как ожидается.

  1. Нажмите **Создать**. Алерт появится в списке.

{% endlist %}