Настройка телеметрии кластера службы Fabric с помощью правил сбора данных и агента Azure Monitor

В этой статье описывается поддерживаемый подход к сбору телеметрии для кластеров Service Fabric с использованием агента Azure Monitor (AMA) и правил сбора данных (DCR).

Используйте это руководство, если вы подключены к новому мониторингу или выполняете миграцию с более старых конфигураций диагностики, таких как Windows Диагностика Azure (WAD), Linux Диагностика Azure (LAD) или агент Log Analytics (также известный как MMA/OMS).

Почему такой подход

  • WAD и LAD устарели и уходят на пенсию 31 марта 2026 года.
  • агент Log Analytics (MMA/OMS) устарел и не поддерживается.
  • AMA + DCR — это поддерживаемая модель приема для гостевых журналов и данных о производительности в Azure Monitor.

Инструкции по миграции Azure Monitor см. в разделе "Миграция с расширения Диагностика Azure на агент Azure Monitor".

Используйте поэтапное развертывание для снижения риска.

  1. Проверьте конвейер AMA + DCR.
  2. Добавьте сигналы Service Fabric.
  3. Вырезать и удалить устаревшие агенты.

Этап 1. Проверка конвейера AMA + DCR

  1. Установите AMA на масштабируемые наборы виртуальных машин кластера или компьютеры.
  2. Создайте и свяжите как минимум один DCR. Сбор данных начинается только после сопоставления.
  3. Убедитесь, что данные телеметрии будут передаваться в журналы Azure Monitor.
  • Журналы событий Windows в таблицу Event.
  • Системный журнал Linux в Syslog таблице.
  • Счетчики производительности в таблице Perf.

Ключевые ссылки:

Этап 2: Добавление сигналов Service Fabric

Сопоставляйте необходимые сигналы службы Fabric и обновляйте область DCR постепенно (например, по типу узла канарии).

  • кластеры Windows: сбор соответствующих каналов событий службы Fabric из журнала событий Windows.
  • Кластеры Linux: сбор категорий syslog и уровней серьезности, используемых для событий Service Fabric.
  • Добавьте необходимые счетчики производительности ОС и обработки для мониторинга инфраструктуры.

Используйте список событий Service Fabric, чтобы определить идентификаторы событий и каналы, необходимые для оповещения и устранения неполадок.

Этап 3. Вырезать и удалить устаревшие агенты

После получения необходимых сигналов через AMA + DCR:

  1. Удалите расширения WAD/LAD.
  2. Удалите расширения агента Log Analytics (MMA/OMS).
  3. Убедитесь, что оповещения, панели мониторинга и запросы продолжают работать.
  4. Убедитесь, что не возникает постоянных ошибок приема, преобразования или доставки DCR.

Минимальные запросы проверки

события Windows

Event
| where TimeGenerated > ago(30m)
| where Source has "ServiceFabric" or RenderedDescription has "Service Fabric"
| take 50

Системный журнал Linux

Syslog
| where TimeGenerated > ago(30m)
| where ProcessName has "ServiceFabric" or SyslogMessage has "ServiceFabric"
| take 50

Счетчики производительности

Perf
| where TimeGenerated > ago(30m)
| summarize AvgValue = avg(CounterValue) by ObjectName, CounterName, InstanceName
| top 50 by AvgValue desc

Дальнейшие действия