Лучшие практики по улучшению производительности разговорного агента

Избегайте проблем с производительностью у разговорных агентов, понимая распространенные точки сбоев и следуя лучшим практикам.

Квоты и лимиты

Изучите квоты и ограничения, такие как RPM (запросы в минуту, где запрос — это сообщение, отправленное агенту), и количество запросов Power Platform, разрешенных в течение 24 часов.

Квоты и ограничения по емкости, предусмотренные планом Microsoft Copilot Studio, распространяются на ваших агентов.

Оптимизируйте производительность своего агента

Для оптимизации производительности вашего агента обратите внимание на следующие рекомендации:

  • Стратегически размещайте API-вызовы и обращения к соединителям в потоках разговоров, чтобы пользователям не приходилось ждать завершения нескольких операций.
  • Где это применимо, используйте переменные для кэширования полученной информации вместо многократных вызовов API или обращений к потокам.
  • Облачные потоки, инициируемые агентами Copilot Studio, могут приводить к задержкам. Вместо этого рассмотрите возможность использования прямых вызовов соединителей или узла отправки HTTP-запрос.
  • Учитывайте различия в производительности и сложности классического NLU и генеративной оркестрации в Copilot Studio. Модели понимания естественной речи (NLU) хорошо работают с конкретными намерениями, но испытывают трудности со сложными запросами. Генеративные модели ИИ справляются с более широким спектром входных данных, но могут увеличивать задержки.
  • Включите экспресс-режим.

Оптимизируйте облачный поток для повышения производительности

Если ваш агент вызывает поток Power Automate, убедитесь, что облачные потоки оптимизированы.