Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Компоненты архитектуры агентов — это фундаментальные строительные блоки, составляющие современные системы агентов ИИ. Эти компоненты работают вместе, позволяя агентам получать ввод пользователей, обрабатывать запросы, получать доступ к внешним ресурсам и предоставлять значимые ответы через скоординированную систему взаимосвязанных сервисов и интерфейсов.
Понимание этих компонентов крайне важно для архитекторов и разработчиков, которые проектируют, внедряют и поддерживают агентные решения в экосистеме Microsoft. Каждый компонент выполняет определённую функцию в рабочем процессе агента. Выбор и настройка этих компонентов напрямую влияют на возможности, производительность и надёжность агента.
Архитектурные решения, которые вы принимаете по этим компонентам, определяют, подходит ли агент для простых разговорных задач или сложных корпоративных рабочих процессов, требующих интеграции с несколькими системами и источниками данных.
Основные архитектурные компоненты
Большинство агентов включают клиентский интерфейс, базовую инфраструктуру, оркестратор, языковую модель и возможности вызова инструментов. Эта стандартная архитектура предоставляет основу для реализации агентов на различных платформах Microsoft.
- Client: Интерфейс, через который пользователи взаимодействуют с агентом, например, через окно чата в Microsoft Teams или в пользовательском приложении.
- Инфраструктура чата/приложения/хранилища: предоставляет базовые услуги для обработки сообщений, управления состоянием и постоянного хранения разговоров или контекста.
- Оркестратор: координирует поток информации между компонентами. Он управляет такими задачами, как распознавание намерений, выполнение рабочих процессов и маршрутизация запросов к соответствующим инструментам или сервисам.
- Языковая модель: ИИ-движок, который интерпретирует пользовательский ввод, генерирует ответы и обеспечивает понимание и генерацию естественного языка.
- Каталог: реестр или каталог доступных навыков, плагинов или действий, которые агент может вызвать для расширения своих возможностей.
- Вызов инструментов: механизм, позволяющий агенту вызывать внешние функции, API или сервисы для выполнения запросов пользователей, выходящих за рамки простого общения.
- API на базе OpenAPI: стандартизированные интерфейсы, позволяющие агенту подключаться к внешним системам и сервисам с использованием спецификаций OpenAPI.
- Семантические индексы: Структуры, позволяющие агенту искать, извлекать и рассуждать на основе корпоративных данных, используя семантическое понимание, а не только ключевые слова.
- MCP-серверы: промежуточное ПО, реализующее протокол Model Context Protocol, позволяющее агентам безопасно обмениваться контекстом и возможностями с внешними инструментами и сервисами.
- Проприетарные протоколы (такие как Direct Line): Пользовательские каналы связи, используемые для соединения агентов с определёнными платформами или сервисами, такими как Direct Line для Bot Framework.
- Парсинг и фрагментирование: процессы, которые разбивают пользовательский ввод или документы на управляемые части для более эффективного анализа и генерации откликов.
- RAI (Ответственный ИИ): обеспечивает этичное и соответствие требованиям на протяжении всего жизненного цикла агента, включая справедливость, прозрачность и гарантии конфиденциальности.
Оркестраторы и языковые модели
Оркестраторы — это компоненты, которые организуют и направляют подсказки к правильному подкомпоненту. Они могут включать потоки с поддержкой ИИ или языковых моделей (например, генеративную оркестрацию в Copilot Studio) либо детерминированные потоки на основе кода (например, темы в Copilot Studio, обычно используемые для управления задачами, такими как ведение журналов аудита или получение данных из каталога). SDK, такие как Semantic Kernel или LangChain, позволяют выполнять оркестрацию как на основе рабочих процессов, так и языковых моделей, но при этом увеличивает сложность всего решения.
При сборе требований к агентному решению собрать достаточно информации о сценарии, чтобы определить, добавляет ли оценка динамического намерения и выполнение задачи ценность (оркестратор языковой модели), или же необходим детерминированный, высокоточный и точный рабочий процесс без допуска вариаций (оркестратор на основе кода).
| Тип | Характеристики | Примеры инструментов | лучше всего подходит для |
|---|---|---|---|
| Динамический поток (неструктурированный) | Входы и инструменты с высокой дисперсией обеспечивают высокую дисперсию в выходах. | Декларативные агенты, генеративная оркестровка | Отлично подходит для резюме, переводов с высокой толерантностью к вариациям |
| Гибридный поток | Высокая сложность разработки для сочетания неточных входных данных с точными выходами. | Semantic Kernel, LangChain | Сложные сценарии |
| Детерминированный поток (структурированный) | Высокая точность входов и выводов. Строгая структура инструмента/процесса. | Потоки Power Automate, код на основе if/then, циклов и операторов case | Отлично подходит для соответствия и процессуальных процессов |
Catalogs
Единый каталог приложений для Microsoft 365 предоставляет управляемый и регулируемый каталог агентов, который позволяет пользователям находить, получать и управлять настраиваемыми агентами на базе ядра и декларативными агентами в интерфейсах Microsoft 365 Copilot.
Существуют внешние каталоги для сценариев, связанных с кросс-агентным приобретением платформ, таких как Model Context Protocol. Эти каталоги могут дополнять каталог Microsoft 365 при их публикации в едином каталоге приложений в клиенте Microsoft.