Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Ta treść dotyczy:🟩v4.0 (wersja ogólnodostępna)
Modele hipoteczne usługi Document Intelligence wykorzystują zaawansowane możliwości optycznego rozpoznawania znaków (OCR) oraz modele głębokiego uczenia do analizowania i wyodrębniania kluczowych pól z dokumentów kredytów hipotecznych. Dokumenty hipoteczne mogą mieć różne formaty i jakość. Interfejs API analizuje dokumenty hipoteczne i zwraca ustrukturyzowaną reprezentację danych JSON. Modele obsługują obecnie tylko dokumenty w języku angielskim. W najnowszej wersji 4.0 można teraz wyodrębniać podpisy z wniosków o kredyt hipoteczny i formularzy.
Obsługiwane typy dokumentów:
- Jednolity wniosek o pożyczkę mieszkaniową (formularz 1003)
- Jednolity raport oceny mieszkaniowej (formularz 1004)
- Weryfikacja formularza zatrudnienia (formularz 1005)
- Jednolite podsumowanie oceny ryzyka kredytowego i przekazania (Formularz 1008)
- Formularz ujawnienia zamykającego
Opcje programowania
Analiza dokumentów w wersji 4.0 (2024-11-30-GA) obsługuje następujące narzędzia, aplikacje i biblioteki:
| Funkcja | Zasoby | Identyfikator modelu |
|---|---|---|
| Model kredytów hipotecznych | • Document Intelligence Studio • REST API • C# SDK• Python SDK• Java SDK• JavaScript SDK |
• prebuilt-mortgage.us.1003 • prebuilt-mortgage.us.1004 • prebuilt-mortgage.us.1005 • prebuilt-mortgage.us.1008 • prebuilt-mortgage.us.closingDisclosure |
Wymagania dotyczące danych wejściowych
Obsługiwane są następujące formaty plików.
| Model | Obraz: JPEG/JPG, PNG, BMP, TIFF, HEIF |
Office: Word (DOCX), Excel (XLSX), PowerPoint (PPTX), HTML |
|
|---|---|---|---|
| Przeczytaj | ✔ | ✔ | ✔ |
| Układ | ✔ | ✔ | ✔ |
| Dokument ogólny | ✔ | ✔ | |
| Wstępnie zbudowana | ✔ | ✔ | |
| Niestandardowa ekstrakcja | ✔ | ✔ | |
| Klasyfikacja niestandardowa | ✔ | ✔ | ✔ |
- Zdjęcia i skanowania: Aby uzyskać najlepsze wyniki, podaj jedno jasne zdjęcie lub wysokiej jakości skanowanie na dokument.
- Pliki PDF i pliki TIFF: w przypadku plików PDF i plików TIFF można przetworzyć maksymalnie 2000 stron. (W przypadku subskrypcji w warstwie Bezpłatna przetwarzane są tylko dwie pierwsze strony).
- Rozmiar pliku: rozmiar pliku do analizowania dokumentów wynosi 500 MB dla warstwy płatnej (S0) i 4 MB dla warstwy bezpłatnej (F0).
- Wymiary obrazu: Wymiary muszą mieć od 50 pikseli x 50 pikseli do 10 000 pikseli x 10 000 pikseli.
- Blokady haseł: jeśli pliki PDF są zablokowane hasłem, należy usunąć blokadę przed przesłaniem.
- Wysokość tekstu: minimalna wysokość tekstu do wyodrębnienia wynosi 12 pikseli dla obrazu 1024 x 768 pikseli. Ten wymiar odpowiada mniej więcej tekstowi o wielkości 8 punktów przy rozdzielczości 150 punktów na cal.
- Trenowanie modelu niestandardowego: maksymalna liczba stron dla danych szkoleniowych to 500 dla niestandardowego modelu szablonu i 50 000 dla niestandardowego modelu neuronowego.
- Trenowanie niestandardowego modelu wyodrębniania: całkowity rozmiar danych treningowych wynosi 50 MB dla modelu szablonowego i 1 GB dla modelu neuronowego.
- Trenowanie niestandardowego modelu klasyfikacji: łączny rozmiar danych treningowych wynosi 1 GB, przy maksymalnie 10 000 stronach. W przypadku wersji 2024-11-30 (GA) całkowity rozmiar danych treningowych wynosi 2 GB z maksymalnie 10 000 stron.
- Typy plików pakietu Office (DOCX, XLSX, PPTX): Maksymalny limit długości ciągu wynosi 8 milionów znaków.
Wypróbuj wyodrębnianie danych z dokumentów hipotecznych
Aby zobaczyć, jak działa wyodrębnianie danych dla usługi dokumentów hipotecznych, potrzebne są następujące zasoby:
Subskrypcja platformy Azure — możesz utworzyć jedną bezpłatnie.
Wystąpienie usługi Document Intelligence w portalu Azure. Aby wypróbować usługę, możesz użyć bezpłatnej warstwy cenowej (
F0). Po wdrożeniu zasobu wybierz pozycję Przejdź do zasobu , aby uzyskać klucz i punkt końcowy.
Document Intelligence Studio
Na stronie głównej Document Intelligence Studio wybierz pozycję Kredyt hipoteczny.
Możesz przeanalizować przykładowe dokumenty hipoteczne lub przekazać własne pliki.
Wybierz przycisk Uruchom analizę i w razie potrzeby skonfiguruj opcje analizy:
Obsługiwane języki i ustawienia regionalne
Zobacz naszą stronę Obsługa języków — wstępnie utworzone modele , aby uzyskać pełną listę obsługiwanych języków.
Wyodrębnianie pól
Aby zapoznać się z obsługiwanymi polami wyodrębniania dokumentów, zobaczstrony schematu modelu dokumentów hipotecznych w naszym przykładowym repozytorium w serwisie GitHub.
Następne kroki
Spróbuj przetwarzać własne formularze i dokumenty za pomocą programu Document Intelligence Studio.
Ukończ przewodnik Szybki start dotyczący analizy dokumentów i rozpocznij tworzenie aplikacji do przetwarzania dokumentów w wybranym języku programowania.