Что такое метрики и оповещения шлюза NAT Azure?

В этой статье приводятся общие сведения обо всех метриках и возможностях диагностики шлюза NAT. В этой статье содержатся общие рекомендации по использованию метрик и оповещений для мониторинга, администрирования и устранения неполадок ресурса шлюза NAT.

Все метрики одинаковы для шлюза NAT standard и StandardV2.

  • Аналитика сети. Аналитика Azure Monitor предоставляет визуальные инструменты для просмотра, мониторинга и диагностики проблем с ресурсом шлюза NAT, Insights предоставляют вам топологическую карту вашей среды Azure и панели мониторинга с метриками.

Схема ресурса шлюза NAT с виртуальными машинами.

Рис. Шлюз NAT Azure для исходящего трафика в Интернет

Общие сведения о метриках

  • Все столбцы могут не присутствовать в каждой таблице.
  • Некоторые столбцы могут находиться за пределами области просмотра страницы. Выберите "Развернуть таблицу ", чтобы просмотреть все доступные столбцы.

Заголовки таблиц

  • Категория — группа метрик или классификация.
  • Метрика — отображаемое имя метрики в том виде, в котором оно отображается на портале Azure.
  • Имя в REST API — имя метрики, указанное в REST API.
  • Единица измерения.
  • Агрегирование — тип агрегирования по умолчанию. Допустимые значения: среднее (среднее), минимальное (минимальное), максимальное (максимальное), общее (сумма), число.
  • Измерения - Измерения, доступные для метрики.
  • Временные интервалы - Интервалы, с которыми производится выборка метрики. Например, PT1M указывает, что метрика выбирается каждую минуту, PT30M — каждые 30 минут, PT1H — каждый час и т. д.
  • Экспорт DS — можно ли экспортировать метрику в журналы Azure Monitor через параметры диагностики. Сведения об экспорте метрик см. в статье "Создание параметров диагностики" в Azure Monitor.
Метрика Имя в REST API Дополнительные метрики платформы Единица измерения Агрегация Измерения Единицы времени Экспорт DS
Байт

Общее количество байтов, переданных за период времени
ByteCount Нет Байт Сумма (Итог) Protocol, Direction PT1M Нет
Доступность Datapath

Доступность тракта передачи данных шлюза NAT
DatapathAvailability Нет Количество Среднее <нет> PT1M Нет
Пакеты

Общее количество пакетов, переданных за период времени
PacketCount Нет Количество Сумма (Итог) Protocol, Direction PT1M Нет
Отброшенные пакеты:

Количество отброшенных пакетов
PacketDropCount Нет Количество Сумма (Итог) <нет> PT1M Нет
Число подключений SNAT

Общее число одновременных активных подключений
SNATConnectionCount Нет Количество Сумма (Итог) Protocol, ConnectionState PT1M Нет
Общее число подключений SNAT

Общее число активных подключений SNAT
TotalConnectionCount Нет Количество Сумма (Итог) Protocol PT1M Нет

Примечание.

Подсчет статистических данных не рекомендуется использовать для каких-либо метрик шлюза NAT. Агрегация Count суммирует число значений метрики, а не сами значения метрики. Используйте агрегацию «Сумма», чтобы получить наилучшее представление значений данных для метрик количества подключений, байтов и пакетов.

Используйте среднее значение для данных о состоянии, представленных наиболее полно, в метрике доступности пути передачи данных.

Сведения о типах агрегирования см. в разделе "Агрегатные типы".

Где найти метрики шлюза NAT

Метрики шлюза NAT можно найти на портале Azure в следующих расположениях.

  • Страница Метрики в разделе Мониторинг на странице ресурсов шлюза NAT.

  • Страница Аналитика в разделе Мониторинг на странице ресурсов шлюза NAT.

    Снимок экрана: аналитические сведения и метрики в сводных данных о шлюзе NAT.

  • Страница Azure Monitor в разделе Метрики.

    Снимок экрана: раздел метрик в Azure Monitor.

Чтобы просмотреть любую из метрик для указанного ресурса шлюза NAT, выполните следующие действия:

  1. Выберите ресурс шлюза NAT, который хотите отслеживать.

  2. В раскрывающемся меню Метрика выберите одну из указанных метрик.

  3. В раскрывающемся меню Агрегирование выберите рекомендуемое агрегирование, указанное в таблице из раздела Общие сведения о метриках.

    Снимок экрана: метрики, настроенные в ресурсе шлюза NAT.

  4. Чтобы настроить временной интервал, за который представлена выбранная метрика на диаграмме метрик, или настроить частоту измерения выбранной метрики, выберите окно Время в правом верхнем углу страницы метрик и внесите необходимые изменения.

    Снимок экрана: конфигурация времени для метрик в ресурсе шлюза NAT.

Использование метрик шлюза NAT

В следующих разделах описано, как использовать каждую метрику шлюза NAT для мониторинга, управления и устранения неполадок с ресурсом шлюза NAT.

Байт

Метрика Bytes показывает объём данных, исходящих через NAT-шлюз и возвращающихся во входящем направлении в ответ на исходящее соединение.

С помощью этой метрики можно сделать следующее:

  • Просмотрите объем данных, обрабатываемых через шлюз NAT для исходящих подключений или обратного входящего трафика.

Чтобы просмотреть объем данных, проходящих через шлюз NAT, выполните следующие действия.

  1. Выберите ресурс шлюза NAT, который хотите отслеживать.

  2. В раскрывающемся меню Метрика выберите метрику Байты.

  3. В раскрывающемся меню Агрегирование выберите Сумма.

  4. Выберите Добавить фильтр.

  5. В раскрывающемся меню Свойство выберите Направление (исходящее | входящее).

  6. В раскрывающемся меню Значения выберите Исходящий, Входящий или оба варианта.

  7. Чтобы просмотреть обработанные входящие или исходящие данные в виде отдельных строк на диаграмме метрик, выберите Применить разделение.

  8. В раскрывающемся меню Значения выберите Направление (Исходящий | Входящий).

Пакеты

Метрика пакетов показывает количество пакетов данных, передаваемых через шлюз NAT.

С помощью этой метрики можно сделать следующее:

  • Убедитесь, что трафик проходит в исходящем направлении или возвращается во входящем направлении через шлюз NAT.

  • Просмотрите объем исходящего трафика через шлюз NAT или возврат входящего трафика.

Чтобы просмотреть количество пакетов, отправленных в одном или обоих направлениях через шлюз NAT, выполните те же действия, описанные в разделе Bytes .

Отброшенные пакеты

Метрика «Отброшенные пакеты» показывает количество пакетов данных, отброшенных шлюзом NAT, когда трафик направляется наружу или возвращается как входящий в ответ на исходящее соединение.

С помощью этой метрики можно сделать следующее:

  • Проверьте, совпадают ли периоды потери пакетов с периодами неудачных SNAT-подключений по метрике SNAT Connection Count.

  • Помогите определить, возникает ли у вас шаблон сбоя исходящих подключений или нехватки портов SNAT.

Возможные причины удаления пакетов:

  • Сбой исходящего соединения может привести к потере пакетов. Сбой подключения может произойти по разным причинам. Ознакомьтесь с руководством по устранению неполадок с подключением шлюза NAT, чтобы помочь вам в дальнейшей диагностике.

Количество подключений SNAT

Метрика счетчика подключений SNAT показывает количество новых подключений SNAT в течение указанного интервала времени. Эту метрику можно фильтровать по состояниям подключения «Попытка» и «Сбой». Количество неудачных подключений больше 0 может указывать на исчерпание портов SNAT.

С помощью этой метрики можно сделать следующее:

  • Оцените работоспособность исходящих подключений.

  • Помогает определить, столкнулся ли ваш шлюз NAT с исчерпанием портов SNAT.

  • Определите, наблюдается ли повторяющаяся проблема со сбоями исходящих подключений.

Чтобы просмотреть состояние соединения ваших подключений, выполните следующие действия.

  1. Выберите ресурс шлюза NAT, который хотите отслеживать.

  2. В раскрывающемся меню Метрика выберите метрику Количество подключений SNAT.

  3. В раскрывающемся меню Агрегирование выберите Сумма.

  4. Выберите Добавить фильтр.

  5. В раскрывающемся меню Свойство выберите Состояние подключения.

  6. В раскрывающемся меню Значения выберите Выполнена попытка, Сбой или оба варианта.

  7. Чтобы просмотреть попытки и неудачные подключения в виде отдельных строк на диаграмме метрик, выберите Применить разделение.

  8. В раскрывающемся меню Значения выберите Состояние подключения.

    Снимок экрана: конфигурация метрик.

Общее число подключений SNAT

Метрика "Общее число подключений SNAT" показывает общее количество активных подключений SNAT, проходящих через шлюз NAT.

Эту метрику можно использовать, чтобы:

  • Оцените объем подключений, проходящих через шлюз NAT.

  • Определите, приближается ли ограничение подключения шлюза NAT.

  • Помогает определить, наблюдаются ли у вас повторяющиеся сбои исходящих подключений.

Возможные причины неудачных подключений:

  • Серия неудачных подключений может возникать по разным причинам. Ознакомьтесь с руководством по устранению неполадок с подключением шлюза NAT, чтобы помочь вам в дальнейшей диагностике.

Примечание.

При подключении шлюза NAT к подсети и общедоступному IP-адресу платформа Azure проверяет работоспособности шлюза NAT путем проведения проверок работоспособности. Эти проверки работоспособности отображаются в метрике числа SNAT-подключений шлюза NAT. Количество подключений, связанных с проверкой работоспособности, может меняться по мере оптимизации службы проверки работоспособности, но их число незначительно и не влияет на способность шлюза NAT устанавливать исходящие подключения.

Доступность Datapath

Метрика доступности datapath измеряет работоспособность ресурса шлюза NAT с течением времени. Эта метрика указывает, доступен ли шлюз NAT для перенаправления исходящего трафика в Интернет. Эта метрика отражает работоспособность инфраструктуры Azure.

Эту метрику можно использовать, чтобы:

  • Отслеживайте доступность шлюза NAT.

  • Изучать платформу, на которой развернут шлюз NAT, и определять ее работоспособность.

  • Определить, связано ли событие с вашим шлюзом NAT или с базовым уровнем передачи данных.

Возможные причины снижения доступности пути к данным:

  • Сбой инфраструктуры.

  • В настроенной подсети шлюза NAT нет работоспособных виртуальных машин. Дополнительные сведения см. в руководстве по устранению неполадок с подключением шлюза NAT.

Оповещения

Оповещения можно настроить в Azure Monitor для всех метрик шлюза NAT. С помощью этих оповещений можно заранее получать уведомления о важных условиях, обнаруженных в ваших данных мониторинга. Они позволяют выявлять и устранять потенциальные проблемы с шлюзом NAT.

Дополнительные сведения о том, как работают оповещения о метриках, см. в статье Оповещения о метриках Azure Monitor. В следующем руководстве описывается настройка некоторых распространенных и рекомендуемых типов оповещений для шлюза NAT.

Оповещения о снижении доступности тракта передачи данных

Настройте оповещение о доступности datapath, чтобы определить проблемы со работоспособностью шлюза NAT.

Рекомендуется настроить оповещение о доступности тракта передачи данных шлюза NAT, когда она падает ниже 90 % в течение 15 минут. Эта конфигурация свидетельствует о том, что ресурс шлюза NAT находится в состоянии пониженного состояния.

Чтобы настроить оповещение о доступности пути к данным, выполните следующие действия.

  1. На странице ресурсов шлюза NAT выберите Оповещения.

  2. Выберите Создать правило генерации оповещений.

  3. В списке сигналов выберите Доступность пути к данным.

  4. В раскрывающемся меню Оператор выберите Меньше.

  5. В раскрывающемся меню Тип агрегирования выберите Среднее.

  6. В поле "Пороговое значение" введите 90%.

  7. В раскрывающемся меню Единица выберите Количество.

  8. В раскрывающемся меню Степень детализации агрегирования (период) выберите 15 минут.

  9. Создайте действие для оповещения, указав имя, тип уведомления и тип действия, которое выполняется при активации оповещения.

  10. Перед развертыванием действия протестируйте группу действий.

  11. Чтобы создать оповещение, выберите Создать.

Примечание.

Гранулярность агрегации — это период времени, за который измеряется доступность тракта передачи данных, чтобы определить, не упала ли она ниже порогового значения. Установка детализации агрегирования менее 5 минут может вызывать ложноположительные оповещения, обнаруживающие шум в тракте передачи данных.

Оповещения об исчерпании портов SNAT

Настройте оповещение на метрику счетчика подключений SNAT, чтобы уведомить вас о сбоях подключения в шлюзе NAT. Количество неудачных подключений больше нуля может указывать на то, что вы достигли лимита подключений на вашем шлюзе NAT или столкнулись с исчерпанием портов SNAT. Узнайте больше, чтобы определить первопричину этих сбоев.

Для создания оповещения сделайте следующее:

  1. На странице ресурсов шлюза NAT выберите Оповещения.

  2. Выберите Создать правило генерации оповещений.

  3. В списке сигналов выберите число подключений SNAT.

  4. В раскрывающемся меню Тип агрегирования выберите Всего.

  5. В раскрывающемся меню "Оператор" выберите "Больше".

  6. В раскрывающемся меню Единица выберите Количество.

  7. В поле "Пороговое значение" введите 0.

  8. В разделе «Разделение по измерениям» в поле «Имя измерения» выберите Состояние подключения.

  9. В разделе «Значения параметра» выберите Неудачные подключения.

  10. В разделе «Когда оценивать» выберите 1 минуту в раскрывающемся меню «Проверять каждые».

  11. Для периода обратного просмотра выберите 5 минут из раскрывающегося меню.

  12. Создайте действие для оповещения, указав имя, тип уведомления и тип действия, которое выполняется при активации оповещения.

  13. Перед развертыванием действия протестируйте группу действий.

  14. Чтобы создать оповещение, выберите Создать.

Примечание.

Исчерпание портов SNAT на ресурсе шлюза NAT встречается редко. Если наблюдается исчерпание SNAT-портов, проверьте, не установлен ли тайм-аут простоя шлюза NAT на значение больше значения по умолчанию — 4 минут. Длительная установка таймера бездействия может привести к тому, что порты SNAT будут удерживаться дольше, что приводит к более быстрому исчерпанию запаса портов SNAT. Вы также можете масштабировать шлюз NAT с дополнительными общедоступными IP-адресами, чтобы увеличить общую инвентаризацию портов SNAT шлюза NAT. Чтобы устранить эти проблемы, ознакомьтесь с руководством по устранению неполадок с подключением шлюза NAT.

Оповещения о превышении общего количества подключений SNAT

Шлюз NAT уровня "Стандартный" и шлюз NAT StandardV2 имеют общий активный предел подключения в 2 миллиона подключений.

Рекомендуется оповещать о числе SNAT-подключений шлюза NAT, когда оно достигает 80% от предельно допустимого количества подключений — 1,6 миллиона.

Примечание.

Пороговое значение 80% является рекомендуемой отправной точкой. Пороговое значение можно настроить на основе шаблонов использования шлюза NAT и тома подключения. В зависимости от количества общедоступных IP-адресов, связанных с шлюзом NAT, и количества конечных точек назначения, можно достичь ограничения подключения раньше 2 миллиона. Шлюз NAT поддерживает до 50 000 подключений на общедоступный IP-адрес для каждой конечной точки назначения.

Чтобы настроить оповещение об общем количестве подключений SNAT, выполните следующие действия.

  1. На странице ресурсов шлюза NAT выберите Оповещения.

  2. Выберите Создать правило генерации оповещений.

  3. В списке сигналов выберите общее число подключений SNAT.

  4. В разделе логики генерации оповещений установите Тип порога на статический.

  5. В раскрывающемся меню типа агрегирования выберите "Всего".

  6. В раскрывающемся меню Value is выберите Больше.

  7. В раскрывающемся меню Единица выберите Количество.

  8. В поле "Пороговое значение " введите 1600 000.

  9. В разделе Когда оценивать установите каждую минуту на 1 минуту.

  10. Установите период ретроспективы на 5 минут.

Примечание.

Период обратного просмотра может потребоваться настроить на основе шаблонов подключения исходящего трафика через шлюз NAT. Если вы обнаружите, что оповещение слишком шумно, установите период обратного просмотра на более длительный период времени.

  1. Создайте действие для оповещения, указав имя, тип уведомления и тип действия, которое выполняется при активации оповещения.

  2. Перед развертыванием действия протестируйте группу действий.

  3. Чтобы создать оповещение, выберите Создать.

Оповещения о работоспособности ресурсов шлюза NAT

Служба работоспособности ресурсов Azure предоставляет информацию о состоянии вашего ресурса шлюза NAT. Работоспособность ресурсов шлюза NAT оценивается путем измерения доступности данных конечной точки шлюза NAT. Вы можете настроить оповещения, чтобы уведомить вас о состоянии работоспособности ресурса шлюза NAT. Дополнительные сведения о работоспособности ресурсов шлюза NAT и настройке оповещений см. в следующем разделе:

Аналитические сведения о сети

Azure Monitor Network Insights позволяет визуализировать настройку инфраструктуры Azure и просматривать все метрики для ресурса шлюза NAT с предварительно настроенной панели мониторинга метрик. Эти визуальные инструменты помогают диагностировать и устранять любые проблемы с ресурсом шлюза NAT.

Просмотр топологии архитектуры Azure

Чтобы просмотреть топологическую карту вашей конфигурации в Azure, сделайте следующее:

  1. На странице ресурсов шлюза NAT в разделе Мониторинг выберите Аналитика.

  2. На целевой странице для Insights есть карта топологии настройки шлюза NAT. На этой карте показана связь между различными компонентами сети (подсетями, виртуальными машинами, общедоступными IP-адресами).

  3. Наведите указатель мыши на любой компонент на карте топологии, чтобы просмотреть сведения о его конфигурации.

    Снимок экрана: раздел аналитических сведений для шлюза NAT.

Просмотр всех метрик шлюза NAT на панели мониторинга

Панель мониторинга метрик позволяет получить более полное представление о производительности и работоспособности ресурса шлюза NAT. На панели мониторинга метрик отображается представление всех метрик для шлюза NAT на одной странице.

  • Чтобы просмотреть на панели мониторинга все метрики шлюза NAT, выберите Show Metrics Pane (Показать область метрик).

    Снимок экрана: панель отображения метрик.

  • Чтобы открыть полностраничное представление всех метрик шлюза NAT, выберите Просмотр подробных метрик.

    Снимок экрана представления подробных метрик.

Дополнительные сведения о том, что показывает каждая из метрик и как их анализировать, см. в разделе Использование метрик шлюза NAT.

Часто задаваемые вопросы о метриках

Какой тип метрик доступен для шлюза NAT?

Шлюз NAT standard и StandardV2 поддерживают многомерные метрики. Вы можете отфильтровать многомерные метрики по разным измерениям, чтобы получить более подробные сведения о предоставленных данных. Метрика счетчика подключений SNAT позволяет фильтровать подключения по попыткам и неудачным подключениям, что позволяет различать различные типы подключений, сделанные шлюзом NAT.

Ознакомьтесь с столбцом измерений в таблице обзора метрик, чтобы узнать, какие измерения доступны для каждой метрики шлюза NAT.

Как долго хранить метрики шлюза NAT?

Все метрики платформы хранятся в течение 93 дней. Если вам требуется долговременный доступ к данным метрик шлюза NAT, эти данные можно получить через REST API метрик. Дополнительные сведения об использовании API см. в пошаговом руководстве по REST API мониторинга Azure.

Примечание.

Параметры диагностики не позволяют экспортировать многомерные метрики в другое место назначения, например в служба хранилища Azure и Log Analytics.

Чтобы получить метрики шлюза NAT, используйте REST API метрик.

Как интерпретировать графики метрик?

Сведения см. в разделе об устранении неполадок с диаграммами метрик, если у вас возникнут проблемы с созданием, изменением параметров или интерпретацией диаграмм в обозревателе метрик Azure.

Следующие шаги