Получение данных из Amazon S3

Прием данных — это процесс загрузки данных из одного или нескольких источников в таблицу в Azure Data Explorer. После приема данные доступны для запроса. В этой статье вы узнаете, как получить данные из Amazon S3 в новую или существующую таблицу.

Дополнительные сведения об Amazon S3 см. в статье "Что такое Amazon S3?

Общие сведения о приеме данных см. в Azure Data Explorer обзор приема данных.

Предварительные требования

Получить данные

  1. Выберите "Запрос" в меню слева.

  2. Щелкните правой кнопкой мыши по базе данных, в которую вы хотите загрузить данные, а затем выберите "Получить данные".

    Снимок экрана: вкладка запроса, контекстное меню для базы данных открыто щелчком правой кнопки мыши и открыто диалоговое окно

Источник

В окне "Получение данных" выбрана вкладка "Источник".

Выберите источник данных из доступного списка. В этом примере загрузка данных из Amazon S3.

Снимок экрана: окно получения данных с выбранной вкладкой источника.

Настройка

  1. Выберите целевую базу данных и таблицу. Чтобы получить данные в новую таблицу, нажмите кнопку +Создать таблицу и введите имя таблицы.

    Примечание.

    Имена таблиц могут составлять до 1024 символов, включая пробелы, буквенно-цифровые символы, дефисы и символы подчеркивания. Специальные символы не поддерживаются.

  2. В поле URI вставьте строка подключения для одного контейнера или отдельного объекта в следующем формате.

    Ба́кет: https://BucketName.s3.RegionName.amazonaws.com

    Объект: ObjectName;AwsCredentials=AwsAccessID,AwsSecretKey

    При необходимости можно применить фильтры контейнеров для фильтрации данных в соответствии с определенным расширением файла.

    Скриншот вкладки настроек с введенной новой таблицей и вставленной строкой подключения Amazon S3.

    Примечание.

    Максимальный размер принимаемого файла составляет 6 ГБ. Рекомендуется загружать файлы размером от 100 МБ до 1 ГБ.

  3. Выберите Далее.

Проверка

Откроется вкладка проверки с предварительным просмотром данных.

Чтобы завершить процесс приема, нажмите кнопку Готово.

Снимок экрана: вкладка

По желанию:

Изменить столбцы

Примечание.

  • Для табличных форматов (CSV, TSV, PSV) невозможно сопоставить столбец дважды. Чтобы сопоставить с существующим столбцом, сначала удалите новый столбец.
  • Нельзя изменить тип существующего столбца. При попытке выполнить сопоставление для столбца, имеющего другой формат, могут отобразиться пустые столбцы.

Изменения, которые вы можете внести в таблицу, зависят от следующих параметров:

  • Тип таблицы — новая или существующая.
  • Тип сопоставления является новым или существующим.
Тип таблицы Тип сопоставления Доступные корректировки
Новая таблица Новое сопоставление Переименование столбца, изменение типа данных, изменение источника данных, преобразование маппинга, добавление столбца, удаление столбца
Существующая таблица Новое сопоставление Добавьте столбец (в котором можно изменить тип данных, переименовать и обновить)
Существующая таблица Существующее сопоставление ничего

Снимок экрана: столбцы, открытые для редактирования.

Трансформации отображений

Некоторые сопоставления форматов данных (Parquet, JSON и Avro) поддерживают простые преобразования при загрузке данных. Чтобы применить преобразования сопоставления, создайте или обновите столбец в окне "Изменение столбцов ".

Преобразования сопоставления можно выполнять в столбце типа string или datetime, если у источника тип данных int или long. Поддерживаются следующие преобразования сопоставлений:

  • DateTimeFromUnixSeconds;
  • DateTimeFromUnixMilliseconds;
  • DateTimeFromUnixMicroseconds;
  • DateTimeFromUnixNanoseconds.

Дополнительные параметры на основе типа данных

Табличные (CSV, TSV, PSV):

  • Если вы используете табличные форматы в существующей таблице, вы можете выбрать раскрывающееся меню сопоставления таблиц и выбрать опцию "Использовать существующее сопоставление". Табличные данные не обязательно включают имена столбцов, которые используются для сопоставления исходных данных с существующими столбцами. При проверке этого параметра сопоставление выполняется по порядку, а схема таблицы остается той же.

  • В противном случае создайте новое сопоставление.

  • Чтобы использовать первую строку в качестве имен столбцов, выберите заголовок первой строки.

    Снимок экрана с параметрами сопоставления.

JSON:

  • Чтобы определить деление данных JSON по уровням вложенности, выберите вложенные уровни от 1 до 100.

Итоги

В окне подготовки данных все три шага отображают зеленые флажки, когда прием данных завершается успешно. Вы можете просмотреть команды, которые используются на каждом шаге, или выбрать карту для запроса, визуализации или удаления загруженных данных.

Снимок экрана: итоговая страница с успешно завершенной загрузкой данных.