Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Это содержимое относится к следующему:🟩v4.0 (GA)
Модели ипотеки document Intelligence используют мощные возможности оптического распознавания символов (OCR) и модели глубокого обучения для анализа и извлечения ключевых полей из ипотечных документов. Ипотечные документы могут иметь различные форматы и качество. API анализирует ипотечные документы и возвращает структурированное представление данных JSON. В настоящее время модели поддерживают только документы на английском языке. С помощью последней версии 4.0 теперь можно извлечь подписи из ипотечных приложений и форм.
Поддерживаемые типы документов:
- Универсальное заявление о жилищном кредите (форма 1003)
- Единый отчет об оценке жилых домов (форма 1004)
- Проверка формы трудоустройства (форма 1005)
- Унифицированная сопроводительная сводка по андеррайтингу (форма 1008)
- Форма раскрытия информации о закрытии сделки
Варианты разработки
Аналитика документов версии 4.0 (2024-11-30-GA) поддерживает следующие средства, приложения и библиотеки:
| Функция | Ресурсы | Идентификатор модели |
|---|---|---|
| Модель ипотеки | • Студия Document Intelligence • REST API • SDK для C# • SDK для Python • SDK для Java • SDK для JavaScript |
• prebuilt-mortgage.us.1003 • prebuilt-mortgage.us.1004 • prebuilt-mortgage.us.1005 • prebuilt-mortgage.us.1008 • prebuilt-mortgage.us.closingDisclosure |
Требования к входным данным
Поддерживаются следующие форматы файлов.
| Модель | Изображение: JPEG/JPG, PNG, BMP, TIFF, HEIF |
Office: Word (DOCX), Excel (XLSX), PowerPoint (PPTX), HTML |
|
|---|---|---|---|
| Читать | ✔ | ✔ | ✔ |
| Макет | ✔ | ✔ | ✔ |
| Общий документ | ✔ | ✔ | |
| Предварительно собранный | ✔ | ✔ | |
| Настраиваемая функция извлечения | ✔ | ✔ | |
| Настраиваемая классификация | ✔ | ✔ | ✔ |
- Фотографии и скан-копии: Для наилучших результатов предоставьте одну четкую фотографию или высококачественную скан-копию для каждого документа.
- PDF и TIFF: для PDF и TIFF можно обработать до 2 000 страниц. (С подпиской на бесплатный уровень обрабатываются только первые две страницы.)
- Размер файла: размер файла для анализа документов составляет 500 МБ для платного уровня (S0) и 4 МБ для бесплатного уровня (F0).
- Размеры изображения: размеры должны находиться в диапазоне от 50 пикселей до 10 000 пикселей x 10 000 пикселей.
- Блокировки паролей. Если pdf-файлы заблокированы паролем, необходимо удалить блокировку перед отправкой.
- Высота текста: минимальная высота извлеченного текста составляет 12 пикселей для изображения 1024 x 768 пикселей. Этот размер соответствует тексту кеглем около 8 пунктов при разрешении 150 точек на дюйм.
- Обучение пользовательской модели: максимальное количество страниц для обучающих данных составляет 500 для пользовательской модели шаблона и 50 000 для пользовательской нейронной модели.
- Обучение пользовательской модели извлечения: общий размер обучающих данных составляет 50 МБ для модели шаблона и 1 ГБ для нейронной модели.
- Обучение пользовательской модели классификации: общий размер обучающих данных составляет 1 ГБ, не более 10 000 страниц. Для 2024-11-30 (GA) общий размер обучающих данных составляет 2 ГБ с максимум 10 000 страниц.
- Типы файлов Office (DOCX, XLSX, PPTX): максимальная длина строки составляет 8 миллионов символов.
Попробуйте извлечение данных ипотечных документов
Чтобы узнать, как работает извлечение данных для службы ипотечных документов, вам потребуется следующее:
Подписка Azure — ее можно создать бесплатно.
Экземпляр Document Intelligence на портале Azure. Вы можете использовать бесплатный ценовой уровень (
F0), чтобы опробовать сервис. После развертывания ресурса выберите Перейти к ресурсу, чтобы получить ключ и конечную точку.
Document Intelligence Studio
На домашней странице Document Intelligence Studio выберите "Ипотека".
Вы можете проанализировать примеры ипотечных документов или отправить собственные файлы.
Нажмите кнопку "Выполнить анализ", а при необходимости настройте параметры анализа:
Поддерживаемые языки и локали
См. страницу Поддержка языков — предварительно созданные модели для получения полного списка поддерживаемых языков.
Извлечение полей
Поддерживаемые поля извлечения данных из документов см. на страницахсхемы модели ипотечных документов в нашем репозитории примеров GitHub.
Следующие шаги
Попробуйте обработать собственные формы и документы с помощью Document Intelligence Studio.
Выполните краткое руководство по анализу документов и начните создавать приложение для обработки документов на выбранном языке разработки.