Skillsets - Get
Извлекает набор навыков в службе поиска.
GET {endpoint}/skillsets('{skillsetName}')?api-version=2026-04-01
Параметры URI
| Имя | В | Обязательно | Тип | Описание |
|---|---|---|---|---|
|
endpoint
|
path | True |
string (uri) |
URL-адрес конечной точки службы поиска. |
|
skillset
|
path | True |
string |
Имя набора навыков. |
|
api-version
|
query | True |
string minLength: 1 |
Версия API, используемая для данной операции. |
Заголовок запроса
| Имя | Обязательно | Тип | Описание |
|---|---|---|---|
| Accept |
Заголовок Accept. |
||
| x-ms-client-request-id |
string (uuid) |
Непрозрачный, глобально уникальный, созданный клиентом идентификатор строки для запроса. |
Ответы
| Имя | Тип | Описание |
|---|---|---|
| 200 OK |
Запрос выполнен успешно. |
|
| Other Status Codes |
Непредвиденное сообщение об ошибке. |
Безопасность
api-key
Тип:
apiKey
В:
header
OAuth2Auth
Тип:
oauth2
Flow:
implicit
URL-адрес авторизации:
https://login.microsoftonline.com/common/oauth2/v2.0/authorize
Области
| Имя | Описание |
|---|---|
| https://search.azure.com/.default |
Примеры
SearchServiceGetSkillset
Образец запроса
GET https://exampleservice.search.windows.net/skillsets('myskillset')?api-version=2026-04-01
Пример ответа
{
"@odata.etag": "0x1234568AE7E58A1",
"name": "myskillset",
"description": "Skillset for extracting entities and more",
"skills": [
{
"@odata.type": "#Microsoft.Skills.Text.LanguageDetectionSkill",
"name": "skill2",
"context": "/document",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "countryHint",
"source": "/document/countryHint",
"inputs": []
}
],
"outputs": [
{
"name": "languageCode",
"targetName": "languageCode"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Text.SplitSkill",
"name": "skill3",
"context": "/document",
"defaultLanguageCode": "en",
"textSplitMode": "pages",
"maximumPageLength": 4000,
"pageOverlapLength": 0,
"maximumPagesToTake": 0,
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "languageCode",
"source": "/document/languageCode",
"inputs": []
}
],
"outputs": [
{
"name": "textItems",
"targetName": "pages"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Text.KeyPhraseExtractionSkill",
"name": "skill4",
"context": "/document/pages/*",
"defaultLanguageCode": "en",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "languageCode",
"source": "/document/languageCode",
"inputs": []
}
],
"outputs": [
{
"name": "keyPhrases",
"targetName": "keyPhrases"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Custom.WebApiSkill",
"name": "skill5",
"context": "/document",
"uri": "https://contoso.example.org/",
"httpMethod": "POST",
"timeout": "PT5S",
"batchSize": 1000,
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "languageCode",
"source": "/document/languageCode",
"inputs": []
}
],
"outputs": [
{
"name": "customresult",
"targetName": "result"
}
],
"httpHeaders": {}
},
{
"@odata.type": "#Microsoft.Skills.Util.DocumentIntelligenceLayoutSkill",
"name": "docIntelligenceLayoutSkill",
"context": "/document",
"outputMode": "oneToMany",
"markdownHeaderDepth": "h3",
"outputFormat": "markdown",
"extractionOptions": [],
"inputs": [
{
"name": "file_data",
"source": "/document/content",
"inputs": []
}
],
"outputs": [
{
"name": "markdown_document",
"targetName": "markdown_document"
}
]
},
{
"@odata.type": "#Microsoft.Skills.Util.DocumentIntelligenceLayoutSkill",
"name": "docIntelligenceLayoutSkill#2",
"context": "/document",
"outputMode": "oneToMany",
"outputFormat": "text",
"extractionOptions": [
"images",
"locationMetadata"
],
"inputs": [
{
"name": "file_data",
"source": "/document/content",
"inputs": []
}
],
"outputs": [
{
"name": "text_sections",
"targetName": "text_sections"
},
{
"name": "normalized_images",
"targetName": "normalized_images"
}
],
"chunkingProperties": {
"unit": "characters",
"maximumLength": 500,
"overlapLength": 50
}
},
{
"@odata.type": "#Microsoft.Skills.Custom.ChatCompletionSkill",
"name": "chatCompletionSkill",
"context": "/document/normalized_images/*",
"uri": "https://azs-grok-aoai.openai.azure.com/openai/deployments/azs-grok-gpt-4o/chat/completions",
"apiKey": "<redacted>",
"extraParametersBehavior": "error",
"inputs": [
{
"name": "text",
"source": "/document/content",
"inputs": []
},
{
"name": "systemMessage",
"source": "/document/system_message",
"inputs": []
},
{
"name": "userMessage",
"source": "/document/user_message",
"inputs": []
},
{
"name": "image",
"source": "/document/normalized_images/*",
"inputs": []
},
{
"name": "imageDetail",
"source": "/document/detail",
"inputs": []
}
],
"outputs": [
{
"name": "response",
"targetName": "response"
}
],
"commonModelParameters": {
"model": "gpt-4o",
"frequencyPenalty": 0,
"presencePenalty": 0,
"maxTokens": 0,
"temperature": 0,
"seed": 0,
"stop": []
},
"extraParameters": {
"safe_mode": true
},
"responseFormat": {
"type": "jsonSchema",
"jsonSchemaProperties": {
"name": "Some Name",
"description": "Some Description",
"strict": true,
"schema": {
"type": "object",
"additionalProperties": false,
"required": [
"steps",
"answer"
],
"properties": "{\"steps\": {\"type\": \"array\", \"description\": \"A list of reasoning steps.\", \"items\": {\"type\": \"string\"}}, \"answer\": {\"type\": \"string\", \"description\": \"The final answer.\"}}"
}
}
}
},
{
"@odata.type": "#Microsoft.Skills.Util.ContentUnderstandingSkill",
"name": "contentUnderstandingSKill",
"context": "/document",
"extractionOptions": [],
"inputs": [
{
"name": "file_data",
"source": "/document/content",
"inputs": []
}
],
"outputs": [
{
"name": "text_sections",
"targetName": "text_sections2"
},
{
"name": "normalized_images",
"targetName": "normalized_images2"
}
]
}
]
}
Определения
| Имя | Описание |
|---|---|
| Accept |
Заголовок Accept. |
|
AIServices |
Мультирегиональный аккаунт сервисного ресурса Azure AI, привязанного к набору навыков. |
|
AIServices |
Ключ аккаунта сервисного ресурса Azure AI, который прикрепляется к набору навыков и используется с поддоменом ресурса. |
|
Azure |
Позволяет создать вектор внедрения для заданного текстового ввода с помощью ресурса Azure OpenAI. |
|
Azure |
Имя модели Azure Open AI, которое будет вызываться. |
|
Chat |
Общие параметры языковой модели для завершения чата. Если они опущены, используются значения по умолчанию. |
|
Chat |
Указывает, как должен работать 'extraParameters' в Azure AI Foundry. По умолчанию 'error'. |
|
Chat |
Определяет, как должна быть сериализована реакция языковой модели. По умолчанию используется 'text'. |
|
Chat |
Указывает, как LLM должен форматировать ответ. |
|
Chat |
Объект, определяющий пользовательскую схему, которую модель будет использовать для структурирования своих выходных данных. |
|
Chat |
Свойства формата отклика схемы JSON. |
|
Chat |
Навык, который вызывает языковую модель через конечную точку Chat Completions Azure AI Foundry. |
|
Cognitive |
Ключ учетной записи с несколькими регионами ресурса службы искусственного интеллекта Azure, подключенного к набору навыков. |
|
Conditional |
Навык, позволяющий сценариям, которым требуется логическое действие для определения данных для назначения выходным данным. |
|
Content |
Это навык, который использует Azure AI Content Understanding для обработки и извлечения структурированных инсайтов из документов, позволяя создавать обогащённый, доступный для поиска контент для улучшения индексации и поиска документов. |
|
Content |
Управляет кратностью для разбивки содержимого. |
|
Content |
Управляет кратностью содержимого, извлекаемого из документа с помощью навыка. |
|
Custom |
Объект, содержащий сведения о найденных совпадениях и связанных метаданных. |
|
Custom |
Сложный объект, который можно использовать для указания альтернативных орфографических или синонимов имени корневой сущности. |
|
Custom |
Навык ищет текст из пользовательского пользовательского списка слов и фраз. |
|
Custom |
Коды языков, поддерживаемые для ввода текста CustomEntityLookupSkill. |
|
Default |
Пустой объект, представляющий ресурс службы искусственного интеллекта Azure по умолчанию для набора навыков. |
|
Document |
Навык, извлекающий содержимое из файла в конвейере обогащения. |
|
Document |
Навык, который извлекает информацию о контенте и макете через Azure AI Services из файлов в конвейере обогащения. |
|
Document |
Управляет кратностью для разбивки содержимого. |
|
Document |
Управляет кратностью содержимого, извлекаемого из документа с помощью навыка. |
|
Entity |
Строка, указывающая, какие категории сущностей следует вернуть. |
|
Entity |
Используя API анализа текста, извлекает связанные сущности из текста. |
|
Entity |
Коды языков, поддерживаемые для вводимого текста EntityRecognitionSkill. |
|
Entity |
С помощью API анализа текста извлекает сущности различных типов из текста. |
|
Error |
Дополнительные сведения об ошибке управления ресурсами. |
|
Error |
Сведения об ошибке. |
|
Error |
Распространенный ответ об ошибке для всех API Azure Resource Manager для возврата сведений об ошибке для неудачных операций. (Это также следует формату ответа об ошибках OData.). |
|
Image |
Навык, который анализирует файлы изображений. Он извлекает широкий набор визуальных функций на основе содержимого изображения. |
|
Image |
Коды языков, поддерживаемые для ввода ImageAnalysisSkill. |
|
Image |
Строка, указывающая, какие сведения для конкретного домена следует возвращать. |
|
Index |
Определяет поведение проекций индекса по отношению к остальной части индексатора. |
|
Input |
Сопоставление полей ввода для навыка. |
|
Key |
Навык, использующий анализ текста для извлечения ключевых фраз. |
|
Key |
Коды языков, поддерживаемые для ввода текста KeyPhraseExtractionSkill. |
|
Language |
Навык, который обнаруживает язык входного текста и сообщает один языковой код для каждого документа, отправленного по запросу. Языковой код связан с оценкой, указывающей достоверность анализа. |
|
Merge |
Навык объединения двух или более строк в одну единую строку с необязательным определяемым пользователем разделителем, разделяющим каждую часть компонента. |
|
Ocr |
Определяет последовательность символов, используемых между строками текста, распознаваемыми навыком OCR. Значением по умолчанию является пробел. |
|
Ocr |
Навык, извлекающий текст из файлов изображений. |
|
Ocr |
Коды языков, поддерживаемые для ввода OcrSkill. |
|
Output |
Сопоставление полей вывода для навыка. |
|
PIIDetection |
Используя API анализа текста, извлекает личную информацию из входного текста и предоставляет возможность маскирования. |
|
PIIDetection |
Строка, указывающая, какой maskingMode следует использовать для маскировки личной информации, обнаруженной во входном тексте. |
|
Search |
Очищает свойство удостоверения источника данных. |
|
Search |
Указывает удостоверение для используемого источника данных. |
|
Search |
Определение дополнительных проекций для вторичных индексов поиска. |
|
Search |
Описание того, какие данные следует хранить в указанном индексе поиска. |
|
Search |
Словарь свойств конфигурации для проекции индекса. Каждое имя — это имя определенного свойства. Каждое значение должно быть примитивным типом. |
|
Search |
Определение дополнительных проекций для больших двоичных объектов Azure, таблиц или файлов, обогащенных данных. |
|
Search |
Определение проекции для хранения данных в файлах Azure. |
|
Search |
Определение проекции для хранения данных в BLOB-объекте Azure. |
|
Search |
Объект контейнера для различных селекторов проекций. |
|
Search |
Описание того, какие данные следует хранить в таблицах Azure. |
|
Search |
Список навыков. |
|
Search |
Ключ шифрования, управляемый клиентом, в Azure Key Vault. Ключи, которые вы создаете и которыми управляете, можно использовать для шифрования или расшифровки хранимых данных, таких как индексы и сопоставления синонимов. |
|
Sentiment |
Коды языков, поддерживаемые SentimentSkill для вводимого текста. |
|
Sentiment |
Используя API анализа текста, вычисляет неструктурированный текст и для каждой записи предоставляет метки тональности (например, "отрицательные", "нейтральные" и "положительные") на основе самой высокой оценки достоверности, найденной службой на уровне предложения и документа. |
|
Shaper |
Навык изменения выходных данных. Он создает сложный тип для поддержки составных полей (также известных как многопартийные поля). |
|
Split |
Навык разделения строки на фрагменты текста. |
|
Split |
Коды языков, поддерживаемые SplitSkill для ввода текста. |
|
Text |
Значение, указывающее, какой режим разделения для выполнения. |
|
Text |
Навык перевода текста с одного языка на другой. |
|
Text |
Коды языков, поддерживаемые TextTranslationSkill для вводимого текста. |
|
Visual |
Строки, указывающие, какие типы визуальных элементов следует возвращать. |
|
Web |
Навык, который может вызывать конечную точку веб-API, позволяя расширить набор навыков, вызывая пользовательский код. |
Accept
Заголовок Accept.
| Значение | Описание |
|---|---|
| application/json;odata.metadata=minimal |
AIServicesAccountIdentity
Мультирегиональный аккаунт сервисного ресурса Azure AI, привязанного к набору навыков.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| description |
string |
Описание сервисного ресурса Azure AI, приложенного к набору навыков. |
| identity | SearchIndexerDataIdentity: |
Назначаемое пользователем управляемое удостоверение, используемое для подключений к службе ИИ. Если это не указано, используется управляемое удостоверение, назначаемое системой. При обновлении набора навыков, если удостоверение не указано, значение остается неизменным. Если установлено значение "none", значение этого свойства очищается. |
| subdomainUrl |
string |
URL конечной точки поддомена/Azure AI Services для соответствующего сервиса ИИ. |
AIServicesAccountKey
Ключ аккаунта сервисного ресурса Azure AI, который прикрепляется к набору навыков и используется с поддоменом ресурса.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| description |
string |
Описание сервисного ресурса Azure AI, приложенного к набору навыков. |
| key |
string |
Ключ, используемый для предоставления ресурса сервиса Azure AI, прикреплённого к набору навыков. |
| subdomainUrl |
string |
URL конечной точки поддомена/Azure AI Services для соответствующего сервиса ИИ. |
AzureOpenAIEmbeddingSkill
Позволяет создать вектор внедрения для заданного текстового ввода с помощью ресурса Azure OpenAI.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| apiKey |
string |
Ключ API указанного ресурса Azure OpenAI. |
| authIdentity | SearchIndexerDataIdentity: |
Назначаемое пользователем управляемое удостоверение, используемое для исходящих подключений. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| deploymentId |
string |
Идентификатор развертывания модели Azure OpenAI в указанном ресурсе. |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| dimensions |
integer (int32) |
Количество измерений, которые должны иметь результирующие векторные представления. Поддерживается только в моделях с внедрением текста-3 и более поздних версий. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| modelName |
Имя модели внедрения, развернутой по указанному пути deploymentId. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
|
| resourceUri |
string (uri) |
URI ресурса ресурса Azure OpenAI. |
AzureOpenAIModelName
Имя модели Azure Open AI, которое будет вызываться.
| Значение | Описание |
|---|---|
| text-embedding-ada-002 |
TextEmbeddingAda002 модель. |
| text-embedding-3-large |
TextEmbedding3Большая модель. |
| text-embedding-3-small |
TextEmbedding3Малая модель. |
| gpt-5-mini |
Модель Gpt5Mini. |
| gpt-5-nano |
Модель Gpt5Nano. |
| gpt-5.4-mini |
Модель GPT54Mini. |
| gpt-5.4-nano |
Модель Gpt54Nano. |
ChatCompletionCommonModelParameters
Общие параметры языковой модели для завершения чата. Если они опущены, используются значения по умолчанию.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| frequencyPenalty |
number (double) |
0 |
Плавающее положение в диапазоне [-2,2], снижающее или увеличивающее вероятность повторных токенов. Значение по умолчанию — 0. |
| maxTokens |
integer (int32) |
Максимальное количество токенов для генерации. |
|
| model |
string |
Имя используемой модели (например, 'gpt-4o' и т.д.). Значение по умолчанию равно null, если не указано. |
|
| presencePenalty |
number (double) |
0 |
Плавающее положение в диапазоне [-2,2], которое наказывает новые токены на основе их существующего присутствия. Значение по умолчанию — 0. |
| seed |
integer (int32) |
Случайное начальное значение для управления детерминированными выходами. Если этот параметр опущен, используется рандомизация. |
|
| stop |
string[] |
Список стоп-последовательностей, которые прекратят генерацию текста. Значение по умолчанию — отсутствует. |
|
| temperature |
number (double) |
0.7 |
Температура выборки. По умолчанию — 0.7. |
ChatCompletionExtraParametersBehavior
Указывает, как должен работать 'extraParameters' в Azure AI Foundry. По умолчанию 'error'.
| Значение | Описание |
|---|---|
| passThrough |
Передает любые дополнительные параметры непосредственно в модель. |
| drop |
Отбрасывает все лишние параметры. |
| error |
Выдает ошибку, если присутствует какой-либо дополнительный параметр. |
ChatCompletionResponseFormat
Определяет, как должна быть сериализована реакция языковой модели. По умолчанию используется 'text'.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| jsonSchemaProperties |
Открытый словарь для расширенных свойств. Обязательно, если 'type' == 'json_schema' |
||
| type | text |
Указывает, как LLM должен форматировать ответ. |
ChatCompletionResponseFormatType
Указывает, как LLM должен форматировать ответ.
| Значение | Описание |
|---|---|
| text |
Формат ответа в виде обычного текста. |
| jsonObject |
Произвольный формат отклика JSON-объектов. |
| jsonSchema |
Формат ответа, привязанный к схеме JSON. |
ChatCompletionSchema
Объект, определяющий пользовательскую схему, которую модель будет использовать для структурирования своих выходных данных.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| additionalProperties |
boolean |
False |
Определяет, допустимо ли для объекта содержать дополнительные ключи и значения, которые не были определены в схеме JSON. По умолчанию — false. |
| properties |
string |
Строка в формате JSON, определяющая свойства и ограничения схемы вывода для модели. |
|
| required |
string[] |
Массив имен свойств, которые должны быть частью ответа модели. Все свойства должны быть включены для структурированных выходов. |
|
| type |
string |
object |
Тип представления схемы. Обычно «объект». Значение по умолчанию — 'object'. |
ChatCompletionSchemaProperties
Свойства формата отклика схемы JSON.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| description |
string |
Описание json-схемы, которой будет придерживаться модель. |
|
| name |
string |
Название схемы json, к которой будет придерживаться модель. |
|
| schema |
Определение схемы. |
||
| strict |
boolean |
True |
Должны ли в ответе модели использоваться структурированные выходные данные. Значение по умолчанию: true. |
ChatCompletionSkill
Навык, который вызывает языковую модель через конечную точку Chat Completions Azure AI Foundry.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
|
| apiKey |
string |
Ключ API для аутентификации в модели. И apiKey, и authIdentity не могут быть указаны одновременно. |
|
| authIdentity | SearchIndexerDataIdentity: |
Назначаемое пользователем управляемое удостоверение, используемое для исходящих подключений. Если указан идентификатор authResourceId и он не указан, используется управляемое удостоверение, назначаемое системой. При обновлении индексатора, если удостоверение не указано, значение остается неизменным. Если установлено значение "none", значение этого свойства очищается. |
|
| commonModelParameters |
Общие параметры языковой модели, которые клиенты могут настраивать. Если этот параметр опущен, будут применяться разумные значения по умолчанию. |
||
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
|
| extraParameters |
Словарь открытого типа для параметров, специфичных для модели, которые должны быть добавлены к вызову завершения чата. Следует шаблону расширяемости Azure AI Foundry. |
||
| extraParametersBehavior | error |
Как Azure AI Foundry обрабатывает дополнительные параметры. Значение по умолчанию — 'error'. |
|
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
||
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
|
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
||
| responseFormat |
Определяет, как LLM должен форматировать свой ответ. По умолчанию используется тип ответа «текст». |
||
| uri |
string |
URL-адрес веб-API. |
CognitiveServicesAccountKey
Ключ учетной записи с несколькими регионами ресурса службы искусственного интеллекта Azure, подключенного к набору навыков.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| description |
string |
Описание сервисного ресурса Azure AI, приложенного к набору навыков. |
| key |
string |
Ключ, используемый для предоставления ресурса сервиса Azure AI, прикреплённого к набору навыков. |
ConditionalSkill
Навык, позволяющий сценариям, которым требуется логическое действие для определения данных для назначения выходным данным.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
ContentUnderstandingSkill
Это навык, который использует Azure AI Content Understanding для обработки и извлечения структурированных инсайтов из документов, позволяя создавать обогащённый, доступный для поиска контент для улучшения индексации и поиска документов.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| chunkingProperties |
Управляет кратностью для разбивки содержимого. |
|
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| extractionOptions |
Управляет кратностью содержимого, извлекаемого из документа с помощью навыка. |
|
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
ContentUnderstandingSkillChunkingProperties
Управляет кратностью для разбивки содержимого.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| maximumLength |
integer (int32) |
Максимальная длина блока в символах. Значение по умолчанию — 500. |
|
| overlapLength |
integer (int32) |
Длина перекрытия между двумя фрагментами текста. Значение по умолчанию — 0. |
|
| unit |
enum:
characters |
characters |
Единица измерения блока. |
ContentUnderstandingSkillExtractionOptions
Управляет кратностью содержимого, извлекаемого из документа с помощью навыка.
| Значение | Описание |
|---|---|
| images |
Укажите, что содержимое изображения должно быть извлечено из документа. |
| locationMetadata |
Укажите, что метаданные местоположения должны быть извлечены из документа. |
CustomEntity
Объект, содержащий сведения о найденных совпадениях и связанных метаданных.
| Имя | Тип | Описание |
|---|---|---|
| accentSensitive |
boolean |
По умолчанию false. Логическое значение, указывающее, должно ли сравнение с именем сущности быть чувствительным к диакритическим знакам. |
| aliases |
Массив сложных объектов, которые можно использовать для указания альтернативных вариантов написания или синонимов к имени корневой сущности. |
|
| caseSensitive |
boolean |
По умолчанию false. Логическое значение, указывающее, следует ли учитывать регистр символов при сравнении с названием сущности. Примеры нечувствительных к падежным совпадениям «Microsoft» могут быть: microsoft, microSoft, MICROSOFT. |
| defaultAccentSensitive |
boolean |
Изменяет значение чувствительности к диакритическим знакам по умолчанию для этой сущности. Он может использоваться для изменения значения по умолчанию для всех значений псевдонимов accentSensitive. |
| defaultCaseSensitive |
boolean |
Изменяет значение чувствительности регистра по умолчанию для этой сущности. Он может использоваться для изменения значения по умолчанию для всех значений псевдонимов caseSensitive. |
| defaultFuzzyEditDistance |
integer (int32) |
Изменяет значение расстояния нечеткого редактирования по умолчанию для этого объекта. Можно использовать для изменения значения по умолчанию для всех псевдонимов fuzzyEditDistance. |
| description |
string |
Это поле можно использовать в качестве сквозного для пользовательских метаданных о совпадающем тексте. Значение этого поля будет отображаться с каждым совпадением сущности в выходных данных навыка. |
| fuzzyEditDistance |
integer (int32) |
Значение по умолчанию — 0. Максимальное значение — 5. Допустимое количество символов, которые могут не соответствовать названию сущности, однако при этом совпадение будет найдено. Возвращается наименьшее возможное значение нечеткости для любого заданного соответствия. Например, если расстояние редактирования установлено на 3, «Windows10» всё равно будет совпадать с «Windows», «Windows10» и «Windows 7». Если параметр чувствительности к регистру имеет значение false, то разница в регистре НЕ считается нечеткостью. |
| id |
string |
Это поле можно использовать в качестве сквозного для пользовательских метаданных о совпадающем тексте. Значение этого поля будет отображаться с каждым совпадением сущности в выходных данных навыка. |
| name |
string |
Дескриптор сущности верхнего уровня. Совпадения в выходных данных навыка будут группироваться по этому названию. Оно должно представлять "нормализованную" форму найденного текста. |
| subtype |
string |
Это поле можно использовать в качестве сквозного для пользовательских метаданных о совпадающем тексте. Значение этого поля будет отображаться с каждым совпадением сущности в выходных данных навыка. |
| type |
string |
Это поле можно использовать в качестве сквозного для пользовательских метаданных о совпадающем тексте. Значение этого поля будет отображаться с каждым совпадением сущности в выходных данных навыка. |
CustomEntityAlias
Сложный объект, который можно использовать для указания альтернативных орфографических или синонимов имени корневой сущности.
| Имя | Тип | Описание |
|---|---|---|
| accentSensitive |
boolean |
Определите, чувствителен ли псевдоним к диакритическим знакам. |
| caseSensitive |
boolean |
Определите, чувствителен ли регистр в псевдониме. |
| fuzzyEditDistance |
integer (int32) |
Определите нечеткое расстояние редактирования псевдонима. |
| text |
string |
Текст псевдонима. |
CustomEntityLookupSkill
Навык ищет текст из пользовательского пользовательского списка слов и фраз.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultLanguageCode |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| entitiesDefinitionUri |
string |
Путь к JSON-файлу или CSV-файлу, который содержит весь целевой текст для сопоставления. Это определение сущности считывается в начале запуска индексатора. Все обновления этого файла во время запуска индексатора не будут входить в силу до последующих запусков. Эта конфигурация должна быть доступна по протоколу HTTPS. |
| globalDefaultAccentSensitive |
boolean |
Глобальный флаг для AccentSensitive. Если Параметр AccentSensitive не задан в CustomEntity, это значение будет значением по умолчанию. |
| globalDefaultCaseSensitive |
boolean |
Глобальный флаг для CaseSensitive. Если Параметр CaseSensitive не задан в CustomEntity, это значение будет значением по умолчанию. |
| globalDefaultFuzzyEditDistance |
integer (int32) |
Глобальный флаг для FuzzyEditDistance. Если не задано значение FuzzyEditDistance в CustomEntity, это значение будет значением по умолчанию. |
| inlineEntitiesDefinition |
Встроенное определение CustomEntity. |
|
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
CustomEntityLookupSkillLanguage
Коды языков, поддерживаемые для ввода текста CustomEntityLookupSkill.
| Значение | Описание |
|---|---|
| da |
Датский |
| de |
German |
| en |
English |
| es |
испанский |
| fi |
Финский |
| fr |
French |
| it |
Italian |
| ko |
Корейский |
| pt |
португальский |
DefaultCognitiveServicesAccount
Пустой объект, представляющий ресурс службы искусственного интеллекта Azure по умолчанию для набора навыков.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| description |
string |
Описание сервисного ресурса Azure AI, приложенного к набору навыков. |
DocumentExtractionSkill
Навык, извлекающий содержимое из файла в конвейере обогащения.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| configuration |
Словарь конфигураций для навыка. |
|
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| dataToExtract |
string |
Тип данных, которые необходимо извлечь для навыка. Если не определено значение contentAndMetadata, будет задано значение ContentAndMetadata. |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
|
| parsingMode |
string |
Синтаксический анализ для навыка. Если он не определен, для этого будет задано значение default. |
DocumentIntelligenceLayoutSkill
Навык, который извлекает информацию о контенте и макете через Azure AI Services из файлов в конвейере обогащения.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
|
| chunkingProperties |
Управляет кратностью для разбивки содержимого. |
||
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
|
| extractionOptions |
Управляет кратностью содержимого, извлекаемого из документа с помощью навыка. |
||
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
||
| markdownHeaderDepth |
enum:
|
h6 |
Глубина заголовков в выходных данных markdown. Значение по умолчанию — h6. |
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
|
| outputFormat |
enum:
|
markdown |
Управляет форматом вывода. По умолчанию используется 'markdown'. |
| outputMode |
enum:
one |
oneToMany |
Управляет кратностью выходных данных, созданных навыком. Значение по умолчанию — oneToMany. |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
DocumentIntelligenceLayoutSkillChunkingProperties
Управляет кратностью для разбивки содержимого.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| maximumLength |
integer (int32) |
Максимальная длина блока в символах. Значение по умолчанию — 500. |
|
| overlapLength |
integer (int32) |
Длина перекрытия между двумя фрагментами текста. Значение по умолчанию — 0. |
|
| unit |
enum:
characters |
characters |
Единица измерения блока. |
DocumentIntelligenceLayoutSkillExtractionOptions
Управляет кратностью содержимого, извлекаемого из документа с помощью навыка.
| Значение | Описание |
|---|---|
| images |
Укажите, что содержимое изображения должно быть извлечено из документа. |
| locationMetadata |
Укажите, что метаданные местоположения должны быть извлечены из документа. |
EntityCategory
Строка, указывающая, какие категории сущностей следует вернуть.
| Значение | Описание |
|---|---|
| location |
Сущности, описывающие физическое расположение. |
| organization |
Сущности, описывающие организацию. |
| person |
Сущности, описывающие человека. |
| quantity |
Сущности, описывающие количество. |
| datetime |
Сущности, описывающие дату и время. |
| url |
Сущности, описывающие URL-адрес. |
|
Сущности, описывающие адрес электронной почты. |
EntityLinkingSkill
Используя API анализа текста, извлекает связанные сущности из текста.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultLanguageCode |
string |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| minimumPrecision |
number (double) minimum: 0maximum: 1 |
Значение от 0 до 1, которое используется только для включения сущностей, оценка достоверности которых превышает указанное значение. Если не задано (по умолчанию) или если явно задано значение NULL, все сущности будут включены. |
| modelVersion |
string |
Версия модели, используемая при вызове службы анализа текста. Он по умолчанию будет доступен по умолчанию, если он не указан. Мы рекомендуем не указывать это значение, если это значение не требуется. |
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
EntityRecognitionSkillLanguage
Коды языков, поддерживаемые для вводимого текста EntityRecognitionSkill.
| Значение | Описание |
|---|---|
| ar |
Arabic |
| cs |
Чешский |
| zh-Hans |
Китайский (упрощённый) |
| zh-Hant |
Китайский (традиционный) |
| da |
Датский |
| nl |
Нидерландский |
| en |
English |
| fi |
Финский |
| fr |
French |
| de |
German |
| el |
Греческий |
| hu |
Hungarian |
| it |
Italian |
| ja |
Japanese |
| ko |
Корейский |
| no |
Норвежский (Bokmaal) |
| pl |
Polish |
| pt-PT |
Португальский (Португалия) |
| pt-BR |
португальский (Бразилия) |
| ru |
Russian |
| es |
испанский |
| sv |
Шведский |
| tr |
Турецкий |
EntityRecognitionSkillV3
С помощью API анализа текста извлекает сущности различных типов из текста.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| categories |
Список категорий сущностей, которые следует извлечь. |
|
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultLanguageCode |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| minimumPrecision |
number (double) minimum: 0maximum: 1 |
Значение от 0 до 1, которое используется только для включения сущностей, оценка достоверности которых превышает указанное значение. Если не задано (по умолчанию) или если явно задано значение NULL, все сущности будут включены. |
| modelVersion |
string |
Версия модели, используемая при вызове API анализа текста. Он по умолчанию будет доступен по умолчанию, если он не указан. Мы рекомендуем не указывать это значение, если это значение не требуется. |
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
ErrorAdditionalInfo
Дополнительные сведения об ошибке управления ресурсами.
| Имя | Тип | Описание |
|---|---|---|
| info |
Дополнительные сведения. |
|
| type |
string |
Дополнительный тип сведений. |
ErrorDetail
Сведения об ошибке.
| Имя | Тип | Описание |
|---|---|---|
| additionalInfo |
Дополнительные сведения об ошибке. |
|
| code |
string |
Код ошибки. |
| details |
Сведения об ошибке. |
|
| message |
string |
Сообщение об ошибке. |
| target |
string |
Целевой объект ошибки. |
ErrorResponse
Распространенный ответ об ошибке для всех API Azure Resource Manager для возврата сведений об ошибке для неудачных операций. (Это также следует формату ответа об ошибках OData.).
| Имя | Тип | Описание |
|---|---|---|
| error |
Объект ошибки. |
ImageAnalysisSkill
Навык, который анализирует файлы изображений. Он извлекает широкий набор визуальных функций на основе содержимого изображения.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultLanguageCode |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| details |
Строка, указывающая, какие сведения для конкретного домена следует возвращать. |
|
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
|
| visualFeatures |
Список визуальных функций. |
ImageAnalysisSkillLanguage
Коды языков, поддерживаемые для ввода ImageAnalysisSkill.
| Значение | Описание |
|---|---|
| ar |
Arabic |
| az |
Азербайджанский |
| bg |
Болгарский |
| bs |
Боснийский (латиница) |
| ca |
Каталанский |
| cs |
Чешский |
| cy |
Валлийский |
| da |
Датский |
| de |
German |
| el |
Греческий |
| en |
English |
| es |
испанский |
| et |
Эстонский |
| eu |
Basque |
| fi |
Финский |
| fr |
French |
| ga |
Ирландский |
| gl |
Галисийский |
| he |
Иврит |
| hi |
Хинди |
| hr |
Croatian |
| hu |
Hungarian |
| id |
Indonesian |
| it |
Italian |
| ja |
Japanese |
| kk |
Казахский |
| ko |
Корейский |
| lt |
Литовский |
| lv |
Латышский |
| mk |
Македонец |
| ms |
Малайский (Малайзия) |
| nb |
Норвежский (букмол) |
| nl |
Нидерландский |
| pl |
Polish |
| prs |
Дари |
| pt-BR |
Португальский (Бразилия) |
| pt |
Португальский (Португалия) |
| pt-PT |
Португальский (Португалия) |
| ro |
Румынский |
| ru |
Russian |
| sk |
Словацкий |
| sl |
Словенский |
| sr-Cyrl |
Сербский — кириллица RS |
| sr-Latn |
Сербский язык — латинский алфавит RS |
| sv |
Шведский |
| th |
Тайский |
| tr |
Турецкий |
| uk |
Ukrainian |
| vi |
Вьетнамский |
| zh |
упрощенный китайский язык |
| zh-Hans |
упрощенный китайский язык |
| zh-Hant |
Китайский традиционный язык |
ImageDetail
Строка, указывающая, какие сведения для конкретного домена следует возвращать.
| Значение | Описание |
|---|---|
| celebrities |
Подробности, признанные знаменитостями. |
| landmarks |
Подробности, распознанные как ориентиры. |
IndexProjectionMode
Определяет поведение проекций индекса по отношению к остальной части индексатора.
| Значение | Описание |
|---|---|
| skipIndexingParentDocuments |
Исходный документ будет пропущен из записи в целевой индекс индексатора. |
| includeIndexingParentDocuments |
Исходный документ будет записан в целевой индекс индексатора. Это шаблон по умолчанию. |
InputFieldMappingEntry
Сопоставление полей ввода для навыка.
| Имя | Тип | Описание |
|---|---|---|
| inputs |
Рекурсивные входные данные, используемые при создании сложного типа. |
|
| name |
string |
Имя входных данных. |
| source |
string |
Источник входных данных. |
| sourceContext |
string |
Исходный контекст, используемый для выбора рекурсивных входных данных. |
KeyPhraseExtractionSkill
Навык, использующий анализ текста для извлечения ключевых фраз.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultLanguageCode |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| maxKeyPhraseCount |
integer (int32) |
Число, указывающее, сколько ключевых фраз нужно возвращать. При отсутствии будут возвращены все определенные ключевые фразы. |
| modelVersion |
string |
Версия модели, используемая при вызове службы анализа текста. Он по умолчанию будет доступен по умолчанию, если он не указан. Мы рекомендуем не указывать это значение, если это значение не требуется. |
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
KeyPhraseExtractionSkillLanguage
Коды языков, поддерживаемые для ввода текста KeyPhraseExtractionSkill.
| Значение | Описание |
|---|---|
| da |
Датский |
| nl |
Нидерландский |
| en |
English |
| fi |
Финский |
| fr |
French |
| de |
German |
| it |
Italian |
| ja |
Japanese |
| ko |
Корейский |
| no |
Норвежский (Bokmaal) |
| pl |
Polish |
| pt-PT |
Португальский (Португалия) |
| pt-BR |
португальский (Бразилия) |
| ru |
Russian |
| es |
испанский |
| sv |
Шведский |
LanguageDetectionSkill
Навык, который обнаруживает язык входного текста и сообщает один языковой код для каждого документа, отправленного по запросу. Языковой код связан с оценкой, указывающей достоверность анализа.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultCountryHint |
string |
Код страны, используемый в качестве указания модели обнаружения языка, если он не может отсодействовать от языка. |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| modelVersion |
string |
Версия модели, используемая при вызове службы анализа текста. Он по умолчанию будет доступен по умолчанию, если он не указан. Мы рекомендуем не указывать это значение, если это значение не требуется. |
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
MergeSkill
Навык объединения двух или более строк в одну единую строку с необязательным определяемым пользователем разделителем, разделяющим каждую часть компонента.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
|
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
|
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
||
| insertPostTag |
string |
Тег указывает конец объединенного текста. По умолчанию тег является пустым пространством. |
|
| insertPreTag |
string |
Тег указывает начало объединенного текста. По умолчанию тег является пустым пространством. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
|
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
OcrLineEnding
Определяет последовательность символов, используемых между строками текста, распознаваемыми навыком OCR. Значением по умолчанию является пробел.
| Значение | Описание |
|---|---|
| space |
Линии разделяются одним символом пробела. |
| carriageReturn |
Линии разделяются символом возврата каретки ("\r'). |
| lineFeed |
Строки разделены одним каналом строк ("\n') символом. |
| carriageReturnLineFeed |
Линии разделены возвратом каретки и символом строки ("\r\n'). |
OcrSkill
Навык, извлекающий текст из файлов изображений.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
|
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
|
| defaultLanguageCode |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
||
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
|
| detectOrientation |
boolean |
False |
Значение, указывающее на включение или отсутствие обнаружения ориентации. По умолчанию — false. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
||
| lineEnding |
Определяет последовательность символов, используемых между строками текста, распознаваемыми навыком OCR. Значением по умолчанию является пробел. |
||
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
|
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
OcrSkillLanguage
Коды языков, поддерживаемые для ввода OcrSkill.
| Значение | Описание |
|---|---|
| af |
Африкаанс |
| sq |
Албанский |
| anp |
Ангика (Деванагири) |
| ar |
Arabic |
| ast |
Астурийский |
| awa |
Авадхи хинди (Деванагири) |
| az |
Азербайджанская (латиница) |
| bfy |
Багхели |
| eu |
Basque |
| be |
Белорусский (кириллица и латиница) |
| be-cyrl |
Белорусский (кириллица) |
| be-latn |
Белорусский (латиница) |
| bho |
Бходжпури хинди (Деванагири) |
| bi |
Бислама |
| brx |
Бодо (Деванагири) |
| bs |
Боснийский (латиница) |
| bra |
Браджбха |
| br |
Бретонский язык |
| bg |
Болгарский |
| bns |
Бундели |
| bua |
Бурят (кириллица) |
| ca |
Каталанский |
| ceb |
Себуано |
| rab |
Чамлинг |
| ch |
Чаморро |
| hne |
Чхаттисгархи (Деванагири) |
| zh-Hans |
упрощенный китайский язык |
| zh-Hant |
Китайский традиционный язык |
| kw |
Корнский язык |
| co |
Корсиканский |
| crh |
Крымскотатарский (латиница) |
| hr |
Croatian |
| cs |
Чешский |
| da |
Датский |
| prs |
Дари |
| dhi |
Дхимал (Деванагири) |
| doi |
Догри (Деванагири) |
| nl |
Нидерландский |
| en |
English |
| myv |
Эрзиа (кириллица) |
| et |
Эстонский |
| fo |
Фарерский |
| fj |
Фиджи |
| fil |
Филиппинский |
| fi |
Финский |
| fr |
French |
| fur |
Frulian |
| gag |
Гагауз (латиница) |
| gl |
Галисийский |
| de |
German |
| gil |
Гилбертезе |
| gon |
Гонди (Деванагири) |
| el |
Греческий |
| kl |
Гренландский |
| gvr |
Гурунг (Деванагири) |
| ht |
Гаитянский креольский |
| hlb |
Халби (Деванагири) |
| hni |
Хани |
| bgc |
Харьянви |
| haw |
Гавайский |
| hi |
Хинди |
| mww |
Хмонг Дав (латинский алфавит) |
| hoc |
Хо (Devanagiri) |
| hu |
Hungarian |
| is |
Исландский |
| smn |
Инари Сами |
| id |
Indonesian |
| ia |
Интерлингва |
| iu |
Inuktitut (латиница) |
| ga |
Ирландский |
| it |
Italian |
| ja |
Japanese |
| Jns |
Жаунсари (Деванагири) |
| jv |
Яванский |
| kea |
Кабувердьяну |
| kac |
Качин (латиница) |
| xnr |
Кангри (Деванагири) |
| krc |
Карачаево-балкарский |
| kaa-cyrl |
Kara-Kalpak (кириллица) |
| kaa |
Kara-Kalpak (латиница) |
| csb |
Кашубян |
| kk-cyrl |
Казахский (кириллица) |
| kk-latn |
Казахский язык (латиница) |
| klr |
Халинг |
| kha |
Кхаси |
| quc |
K'iche' |
| ko |
Корейский |
| kfq |
Страх |
| kpy |
Коряк |
| kos |
Косраеан |
| kum |
Кумык (кириллица) |
| ku-arab |
Курдский (арабский) |
| ku-latn |
Курдский (латиница) |
| kru |
Курух (Деванагири) |
| ky |
Киргизский (кириллица) |
| lkt |
Лакота |
| la |
Латынь |
| lt |
Литовский |
| dsb |
Нижний Сорбиан |
| smj |
Лул Сами |
| lb |
Люксембургский |
| bfz |
Махасу пахари (Деванагири) |
| ms |
Малайский (латиница) |
| mt |
Мальтийский |
| kmj |
Малто (Деванагири) |
| gv |
Manx |
| mi |
Маори |
| mr |
Маратхи |
| mn |
Монгольский (кириллица) |
| cnr-cyrl |
Монтенегрин (Кириллица) |
| cnr-latn |
Черногорский (латиница) |
| nap |
Неаполитанский |
| ne |
Непальский |
| niu |
Ниуэан |
| nog |
Ногай |
| sme |
Северный Сами (латиница) |
| nb |
Норвежский |
| no |
Норвежский |
| oc |
Окситанский |
| os |
осетинский язык |
| ps |
Пушту |
| fa |
Персидский |
| pl |
Polish |
| pt |
португальский |
| pa |
Пенджаби (арабский) |
| ksh |
Рипуарский диалект |
| ro |
Румынский |
| rm |
романшский |
| ru |
Russian |
| sck |
Садри (Деванагири) |
| sm |
Самоан (латиница) |
| sa |
Санскрит (Devanagiri) |
| sat |
Сантали (Деванагири) |
| sco |
Шотландцы |
| gd |
Шотландский гэльский язык |
| sr |
Сербский (латиница) |
| sr-Cyrl |
Сербский (кириллица) |
| sr-Latn |
Сербский (латиница) |
| xsr |
Шерпа (Деванагири) |
| srx |
Сирмаури (Деванагири) |
| sms |
Skolt Sami |
| sk |
Словацкий |
| sl |
Словенский |
| so |
Сомалийский (арабский) |
| sma |
Южный Сами |
| es |
испанский |
| sw |
Суахили (латиница) |
| sv |
Шведский |
| tg |
Таджикский (кириллица) |
| tt |
Татарский (латиница) |
| tet |
Тетум |
| thf |
Тхангми |
| to |
Тонга |
| tr |
Турецкий |
| tk |
Туркменский (латиница) |
| tyv |
Тувинский |
| hsb |
Верхний Сорбиан |
| ur |
Урду |
| ug |
Уйгур (арабский) |
| uz-arab |
Узбекистан (арабский) |
| uz-cyrl |
Узбекский (кириллица) |
| uz |
Узбекский (латиница) |
| vo |
Волапюк |
| wae |
Вальзер |
| cy |
Валлийский |
| fy |
Западнофризский |
| yua |
Юкатекский майя |
| za |
Чжуан |
| zu |
зулу |
| unk |
Неизвестно (все) |
OutputFieldMappingEntry
Сопоставление полей вывода для навыка.
| Имя | Тип | Описание |
|---|---|---|
| name |
string |
Имя выходных данных, определяемое навыком. |
| targetName |
string |
Целевое имя выходных данных. Он является необязательным и по умолчанию является именем. |
PIIDetectionSkill
Используя API анализа текста, извлекает личную информацию из входного текста и предоставляет возможность маскирования.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultLanguageCode |
string |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| domain |
string |
Если задано, присвойте домену PII только подмножество категорий сущностей. Возможные значения включают: "phi", "none". Значение по умолчанию — none. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| maskingCharacter |
string maxLength: 1 |
Символ, используемый для маскирования текста, если параметр maskingMode задается для замены. Значение по умолчанию — "*". |
| maskingMode |
Параметр, который предоставляет различные способы маскировки личной информации, обнаруженной во входном тексте. Значение по умолчанию — none. |
|
| minimumPrecision |
number (double) minimum: 0maximum: 1 |
Значение от 0 до 1, которое используется только для включения сущностей, оценка достоверности которых превышает указанное значение. Если не задано (по умолчанию) или если явно задано значение NULL, все сущности будут включены. |
| modelVersion |
string |
Версия модели, используемая при вызове службы анализа текста. Он по умолчанию будет доступен по умолчанию, если он не указан. Мы рекомендуем не указывать это значение, если это значение не требуется. |
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
|
| piiCategories |
string[] |
Список категорий сущностей PII, которые следует извлечь и маскировать. |
PIIDetectionSkillMaskingMode
Строка, указывающая, какой maskingMode следует использовать для маскировки личной информации, обнаруженной во входном тексте.
| Значение | Описание |
|---|---|
| none |
Маскирование не происходит, и выходные данные maskedText не будут возвращены. |
| replace |
Заменяет обнаруженные сущности символом, заданным в параметре maskingCharacter. Символ будет повторяться в длину обнаруженной сущности, чтобы смещения соответствовали как входному тексту, так и выходному маскированного текста. |
SearchIndexerDataNoneIdentity
Очищает свойство удостоверения источника данных.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Фрагмент URI, указывающий тип удостоверения. |
SearchIndexerDataUserAssignedIdentity
Указывает удостоверение для используемого источника данных.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Фрагмент URI, указывающий тип удостоверения. |
| userAssignedIdentity |
string |
Полный идентификатор ресурса Azure назначаемого пользователем управляемого удостоверения обычно в форме "/subscriptions/12345678-1234-1234-1234-1234567890ab/resourceGroups/rg/providers/Microsoft.ManagedIdentity/userAssignedIdentities/myId", который должен быть назначен службе поиска. |
SearchIndexerIndexProjection
Определение дополнительных проекций для вторичных индексов поиска.
| Имя | Тип | Описание |
|---|---|---|
| parameters |
Словарь свойств конфигурации для проекции индекса. Каждое имя — это имя определенного свойства. Каждое значение должно быть примитивным типом. |
|
| selectors |
Список проекций, которые должны быть выполнены для индексов вторичного поиска. |
SearchIndexerIndexProjectionSelector
Описание того, какие данные следует хранить в указанном индексе поиска.
| Имя | Тип | Описание |
|---|---|---|
| mappings |
Сопоставления для проекции, или какой источник должен быть сопоставлен с каким полем в целевом индексе. |
|
| parentKeyFieldName |
string |
Имя поля в индексе поиска, с которым сопоставляется значение ключа родительского документа. Должно быть строковым полем, которое можно фильтровать, а не ключевым полем. |
| sourceContext |
string |
Исходный контекст для проекций. Представляет кратность, при которой документ будет разделен на несколько вложенных документов. |
| targetIndexName |
string |
Имя поискового индекса для проекта. Должен иметь ключевое поле с набором анализатора keyword. |
SearchIndexerIndexProjectionsParameters
Словарь свойств конфигурации для проекции индекса. Каждое имя — это имя определенного свойства. Каждое значение должно быть примитивным типом.
| Имя | Тип | Описание |
|---|---|---|
| projectionMode |
Определяет поведение проекций индекса по отношению к остальной части индексатора. |
SearchIndexerKnowledgeStore
Определение дополнительных проекций для больших двоичных объектов Azure, таблиц или файлов, обогащенных данных.
| Имя | Тип | Описание |
|---|---|---|
| identity | SearchIndexerDataIdentity: |
Управляемая идентификация, назначенная пользователем, используемая для подключения к служба хранилища Azure при написании проекций хранилища знаний. Если строка подключения указывает на идентичность (ResourceId), но она не указана, используется управляемая идентичность, назначенная системой. При обновлении индексатора, если удостоверение не указано, значение остается неизменным. Если установлено значение "none", значение этого свойства очищается. |
| projections |
Список дополнительных проекций, выполняемых во время индексирования. |
|
| storageConnectionString |
string |
Проекции строка подключения к аккаунту хранения будут сохранены. |
SearchIndexerKnowledgeStoreFileProjectionSelector
Определение проекции для хранения данных в файлах Azure.
| Имя | Тип | Описание |
|---|---|---|
| generatedKeyName |
string |
Имя созданного ключа для хранения проекции. |
| inputs |
Вложенные входные данные для сложных проекций. |
|
| referenceKeyName |
string |
Имя ссылочного ключа для другой проекции. |
| source |
string |
Исходные данные для проекта. |
| sourceContext |
string |
Исходный контекст для сложных проекций. |
| storageContainer |
string |
Контейнер BLOB-объектов для хранения проекций. |
SearchIndexerKnowledgeStoreObjectProjectionSelector
Определение проекции для хранения данных в BLOB-объекте Azure.
| Имя | Тип | Описание |
|---|---|---|
| generatedKeyName |
string |
Имя созданного ключа для хранения проекции. |
| inputs |
Вложенные входные данные для сложных проекций. |
|
| referenceKeyName |
string |
Имя ссылочного ключа для другой проекции. |
| source |
string |
Исходные данные для проекта. |
| sourceContext |
string |
Исходный контекст для сложных проекций. |
| storageContainer |
string |
Контейнер BLOB-объектов для хранения проекций. |
SearchIndexerKnowledgeStoreProjection
Объект контейнера для различных селекторов проекций.
| Имя | Тип | Описание |
|---|---|---|
| files |
Проекции в Azure Файловое хранилище. |
|
| objects |
Projections to Azure Blob storage. |
|
| tables |
Projections to Azure Table storage. |
SearchIndexerKnowledgeStoreTableProjectionSelector
Описание того, какие данные следует хранить в таблицах Azure.
| Имя | Тип | Описание |
|---|---|---|
| generatedKeyName |
string |
Имя созданного ключа для хранения проекции. |
| inputs |
Вложенные входные данные для сложных проекций. |
|
| referenceKeyName |
string |
Имя ссылочного ключа для другой проекции. |
| source |
string |
Исходные данные для проекта. |
| sourceContext |
string |
Исходный контекст для сложных проекций. |
| tableName |
string |
Имя таблицы Azure для хранения проецируемых данных. |
SearchIndexerSkillset
Список навыков.
| Имя | Тип | Описание |
|---|---|---|
| @odata.etag |
string |
ETag набора навыков. |
| cognitiveServices | CognitiveServicesAccount: |
Подробности о сервисе Azure AI, который используется при выполнении навыков. |
| description |
string |
Описание набора навыков. |
| encryptionKey |
Описание ключа шифрования, созданного в Azure Key Vault. Этот ключ используется для дополнительного уровня шифрования в состоянии покоя для определения вашего набора навыков, когда вы хотите быть полностью уверены, что никто, даже Microsoft, не сможет расшифровать ваше определение. После шифрования определения набора навыков он всегда будет оставаться зашифрованным. Служба поиска будет игнорировать попытки установить для этого свойства значение null. Это свойство можно изменить по мере необходимости, если вы хотите повернуть ключ шифрования; Определение набора навыков не будет затронуто. Шифрование с помощью ключей, управляемых клиентом, недоступно для бесплатных служб поиска и доступно только для платных служб, созданных 1 января 2019 г. |
|
| indexProjections |
Определение дополнительных проекций для вторичных индексов поиска. |
|
| knowledgeStore |
Определение дополнительных проекций на blob, таблицу или файлы Azure с обогащёнными данными. |
|
| name |
string |
Имя набора навыков. |
| skills |
SearchIndexerSkill[]:
|
Список навыков в наборе навыков. |
SearchResourceEncryptionKey
Ключ шифрования, управляемый клиентом, в Azure Key Vault. Ключи, которые вы создаете и которыми управляете, можно использовать для шифрования или расшифровки хранимых данных, таких как индексы и сопоставления синонимов.
| Имя | Тип | Описание |
|---|---|---|
| accessCredentials.applicationId |
string |
Идентификатор приложения AAD, которому было предоставлено необходимые разрешения на доступ к Azure Key Vault, который будет использоваться при шифровании неактивных данных. Идентификатор приложения не следует путать с идентификатором объекта для приложения AAD. |
| accessCredentials.applicationSecret |
string |
Ключ проверки подлинности указанного приложения AAD. |
| identity | SearchIndexerDataIdentity: |
Явное управляемое удостоверение, используемое для этого ключа шифрования. Если не указано, а свойство учетных данных доступа равно NULL, используется управляемое удостоверение, назначаемое системой. При обновлении ресурса, если явное удостоверение не указано, оно остается неизменным. Если задано значение none, то значение этого свойства очищается. |
| keyVaultKeyName |
string |
Имя ключа Azure Key Vault, используемого для шифрования неактивных данных. |
| keyVaultKeyVersion |
string |
Версия ключа Azure Key Vault, используемая для шифрования неактивных данных. |
| keyVaultUri |
string |
Универсальный код ресурса (URI) Хранилища ключей Azure, который также называется DNS-именем, который содержит ключ, используемый для шифрования неактивных данных. Пример URI может быть |
SentimentSkillLanguage
Коды языков, поддерживаемые SentimentSkill для вводимого текста.
| Значение | Описание |
|---|---|
| da |
Датский |
| nl |
Нидерландский |
| en |
English |
| fi |
Финский |
| fr |
French |
| de |
German |
| el |
Греческий |
| it |
Italian |
| no |
Норвежский (Bokmaal) |
| pl |
Polish |
| pt-PT |
Португальский (Португалия) |
| ru |
Russian |
| es |
испанский |
| sv |
Шведский |
| tr |
Турецкий |
SentimentSkillV3
Используя API анализа текста, вычисляет неструктурированный текст и для каждой записи предоставляет метки тональности (например, "отрицательные", "нейтральные" и "положительные") на основе самой высокой оценки достоверности, найденной службой на уровне предложения и документа.
| Имя | Тип | Default value | Описание |
|---|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
|
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
|
| defaultLanguageCode |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
||
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
|
| includeOpinionMining |
boolean |
False |
Если задано значение true, выходные данные навыка будут содержать сведения из анализа текста для интеллектуального анализа мнений, а именно целевые объекты (существительные или глаголы) и связанные с ними оценки (прилагательные) в тексте. По умолчанию — false. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
||
| modelVersion |
string |
Версия модели, используемая при вызове службы анализа текста. Он по умолчанию будет доступен по умолчанию, если он не указан. Мы рекомендуем не указывать это значение, если это значение не требуется. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
|
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
ShaperSkill
Навык изменения выходных данных. Он создает сложный тип для поддержки составных полей (также известных как многопартийные поля).
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
SplitSkill
Навык разделения строки на фрагменты текста.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultLanguageCode |
Значение, указывающее, какой языковой код следует использовать. По умолчанию — |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| maximumPageLength |
integer (int32) |
Требуемая максимальная длина страницы. Значение по умолчанию — 10000. |
| maximumPagesToTake |
integer (int32) |
Применимо только в том случае, если для параметра textSplitMode установлено значение 'pages'. Если указано, SplitSkill прекратит разделение после обработки первых страниц 'maximumPagesToTake', чтобы повысить производительность, когда требуется всего несколько начальных страниц из каждого документа. |
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
|
| pageOverlapLength |
integer (int32) |
Применимо только в том случае, если для параметра textSplitMode установлено значение 'pages'. Если указано, n+1-й чанк будет начинаться с этим количеством символов/токенов с конца n-го чанка. |
| textSplitMode |
Значение, указывающее, какой режим разделения для выполнения. |
SplitSkillLanguage
Коды языков, поддерживаемые SplitSkill для ввода текста.
| Значение | Описание |
|---|---|
| am |
Амхарский |
| bs |
Боснийский |
| cs |
Чешский |
| da |
Датский |
| de |
German |
| en |
English |
| es |
испанский |
| et |
Эстонский |
| fi |
Финский |
| fr |
French |
| he |
Иврит |
| hi |
Хинди |
| hr |
Croatian |
| hu |
Hungarian |
| id |
Indonesian |
| is |
Исландский |
| it |
Italian |
| ja |
Japanese |
| ko |
Корейский |
| lv |
Латышский |
| nb |
Норвежский |
| nl |
Нидерландский |
| pl |
Polish |
| pt |
Португальский (Португалия) |
| pt-br |
португальский (Бразилия) |
| ru |
Russian |
| sk |
Словацкий |
| sl |
Словенский |
| sr |
Сербский |
| sv |
Шведский |
| tr |
Турецкий |
| ur |
Урду |
| zh |
Китайский (упрощённый) |
TextSplitMode
Значение, указывающее, какой режим разделения для выполнения.
| Значение | Описание |
|---|---|
| pages |
Разделить текст на отдельные страницы. |
| sentences |
Разделить текст на отдельные предложения. |
TextTranslationSkill
Навык перевода текста с одного языка на другой.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| defaultFromLanguageCode |
Код языка для перевода документов из документов, которые не указывают язык явным образом. |
|
| defaultToLanguageCode |
Код языка для перевода документов в документы, которые не указывают язык явным образом. |
|
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
|
| suggestedFrom |
Код языка для перевода документов из случаев, когда не указан параметр defaultFromLanguageCode, и автоматическое обнаружение языка не выполнено. По умолчанию — |
TextTranslationSkillLanguage
Коды языков, поддерживаемые TextTranslationSkill для вводимого текста.
| Значение | Описание |
|---|---|
| af |
Африкаанс |
| ar |
Arabic |
| bn |
Бенгальский |
| bs |
Боснийский (латиница) |
| bg |
Болгарский |
| yue |
Кантонский (традиционные иероглифы) |
| ca |
Каталанский |
| zh-Hans |
упрощенный китайский язык |
| zh-Hant |
Китайский традиционный язык |
| hr |
Croatian |
| cs |
Чешский |
| da |
Датский |
| nl |
Нидерландский |
| en |
English |
| et |
Эстонский |
| fj |
Фиджи |
| fil |
Филиппинский |
| fi |
Финский |
| fr |
French |
| de |
German |
| el |
Греческий |
| ht |
Гаитянский креольский |
| he |
Иврит |
| hi |
Хинди |
| mww |
Хмонг дау |
| hu |
Hungarian |
| is |
Исландский |
| id |
Indonesian |
| it |
Italian |
| ja |
Japanese |
| sw |
Kiswahili |
| tlh |
Клингонский |
| tlh-Latn |
Klingon (латинский скрипт) |
| tlh-Piqd |
Клингон (скрипт Клингон) |
| ko |
Корейский |
| lv |
Латышский |
| lt |
Литовский |
| mg |
Малагасийский |
| ms |
Малайский |
| mt |
Мальтийский |
| nb |
Норвежский |
| fa |
Персидский |
| pl |
Polish |
| pt |
португальский |
| pt-br |
португальский (Бразилия) |
| pt-PT |
Португальский (Португалия) |
| otq |
Керетаро отоми |
| ro |
Румынский |
| ru |
Russian |
| sm |
Самоа |
| sr-Cyrl |
Сербский (кириллица) |
| sr-Latn |
Сербский (латиница) |
| sk |
Словацкий |
| sl |
Словенский |
| es |
испанский |
| sv |
Шведский |
| ty |
Таитянский язык |
| ta |
Tamil |
| te |
Телугу |
| th |
Тайский |
| to |
Тонга |
| tr |
Турецкий |
| uk |
Ukrainian |
| ur |
Урду |
| vi |
Вьетнамский |
| cy |
Валлийский |
| yua |
Юкатекский майя |
| ga |
Ирландский |
| kn |
Каннада |
| mi |
Маори |
| ml |
Малаялам |
| pa |
Панджаби |
VisualFeature
Строки, указывающие, какие типы визуальных элементов следует возвращать.
| Значение | Описание |
|---|---|
| adult |
Визуальные функции, распознанные как взрослые люди. |
| brands |
Визуальные функции, признанные коммерческими брендами. |
| categories |
Категории. |
| description |
Description. |
| faces |
Визуальные функции, распознанные как лица людей. |
| objects |
Визуальные функции, распознанные как объекты. |
| tags |
Метки. |
WebApiSkill
Навык, который может вызывать конечную точку веб-API, позволяя расширить набор навыков, вызывая пользовательский код.
| Имя | Тип | Описание |
|---|---|---|
| @odata.type |
string:
#Microsoft. |
Дискриминатор производных типов. |
| authIdentity | SearchIndexerDataIdentity: |
Назначаемое пользователем управляемое удостоверение, используемое для исходящих подключений. Если указан идентификатор authResourceId и он не указан, используется управляемое удостоверение, назначаемое системой. При обновлении индексатора, если удостоверение не указано, значение остается неизменным. Если установлено значение "none", значение этого свойства очищается. |
| authResourceId |
string |
Применяется к пользовательским навыкам, которые подключаются к внешнему коду в функции Azure или другом приложении, которое предоставляет преобразования. Это значение должно быть идентификатором приложения, созданным для функции или приложения при регистрации в Azure Active Directory. При указании пользовательский навык подключается к функции или приложению с помощью управляемого идентификатора (назначаемого системой или пользователем) службы поиска и маркера доступа функции или приложения, используя это значение в качестве идентификатора ресурса для создания области маркера доступа. |
| batchSize |
integer (int32) |
Требуемый размер пакета, указывающий количество документов. |
| context |
string |
Представляет уровень, на котором выполняются операции, такие как корневой каталог документа или содержимое документа (например, /document или /document/content). Значение по умолчанию — /document. |
| degreeOfParallelism |
integer (int32) |
Если задано, количество параллельных вызовов, которые можно выполнить в веб-API. |
| description |
string |
Описание навыка, описывающего входные данные, выходные данные и использование навыка. |
| httpHeaders |
object |
Заголовки, необходимые для выполнения http-запроса. |
| httpMethod |
string |
Метод http-запроса. |
| inputs |
Входные данные навыков могут быть столбцом в исходном наборе данных или выходными данными вышестоящего навыка. |
|
| name |
string |
Имя навыка, который однозначно идентифицирует его в наборе навыков. Навык без определенного имени будет указан по умолчанию для его 1-го индекса в массиве навыков, префиксированного символом "#". |
| outputs |
Выходные данные навыка — это поле в индексе поиска или значение, которое можно использовать в качестве входных данных другим навыком. |
|
| timeout |
string (duration) |
Требуемое время ожидания запроса. Значение по умолчанию — 30 секунд. |
| uri |
string |
URL-адрес веб-API. |