Modele dokumentów hipotecznych analizy dokumentów

Artykuł
12/12/2024

Ta zawartość dotyczy: wersja 4.0 (ogólna dostępność)

Modele kredytów hipotecznych analizy dokumentów wykorzystują zaawansowane funkcje optycznego rozpoznawania znaków (OCR) i modeli uczenia głębokiego do analizowania i wyodrębniania kluczowych pól z dokumentów hipotecznych. Dokumenty hipoteczne mogą mieć różne formaty i jakość. Interfejs API analizuje dokumenty hipoteczne i zwraca ustrukturyzowaną reprezentację danych JSON. Modele obsługują obecnie tylko dokumenty w języku angielskim. Dzięki najnowszej wersji 4.0 można teraz wyodrębnić podpisy z wniosków o kredyt hipoteczny i formularze.

Obsługiwane typy dokumentów:

Jednolity wniosek o pożyczkę mieszkaniową (formularz 1003)
Jednolity raport oceny mieszkaniowej (formularz 1004)
Weryfikacja formularza zatrudnienia (formularz 1005)
Uniform Underwriting and Transmital Summary (Formularz 1008)
Formularz ujawnienia zamykającego

Opcje programowania

Analiza dokumentów w wersji 4.0 (2024-11-30-GA) obsługuje następujące narzędzia, aplikacje i biblioteki:

Funkcja	Zasoby	Model ID
Model kredytów hipotecznych	• Document Intelligence Studio • REST API • C# SDK • Python SDK• Java SDK • JavaScript SDK	• prebuilt-mortgage.us.1003 • prebuilt-mortgage.us.1004 • prebuilt-mortgage.us.1005 • prebuilt-mortgage.us.1008 • prebuilt-mortgage.us.closingDisclosure

Wymagania dotyczące danych wejściowych

Obsługiwane formaty plików:

Model	PDF	Obraz: `JPEG/JPG`, , `BMPPNG`, , `TIFFHEIF`	Microsoft Office: Word (), Excel (`XLSXDOCX`), PowerPoint (`PPTX`), HTML
Przeczytaj	✔	✔	✔
Układ	✔	✔	✔
Dokument ogólny	✔	✔
Wstępnie utworzona	✔	✔
Niestandardowe wyodrębnianie	✔	✔
Klasyfikacja niestandardowa	✔	✔	✔

Aby uzyskać najlepsze wyniki, podaj jedno jasne zdjęcie lub wysokiej jakości skanowanie na dokument.
W przypadku plików PDF i TIFF można przetworzyć maksymalnie 2000 stron (w przypadku subskrypcji warstwy Bezpłatna przetwarzane są tylko pierwsze dwie strony).
Rozmiar pliku do analizowania dokumentów wynosi 500 MB dla warstwy płatnej (S0) i 4 MB za bezpłatną (F0).
Wymiary obrazu muszą mieć od 50 pikseli x 50 pikseli do 10 000 pikseli x 10 000 pikseli.
Jeśli pliki PDF są zablokowane hasłem, przed ich przesłaniem usuń blokadę.
Minimalna wysokość tekstu do wyodrębnienia to 12 pikseli dla obrazu o rozmiarze 1024 x 768 pikseli. Ten wymiar odpowiada tekstowi 8 punktowemu na 150 kropek na cal (DPI).
W przypadku trenowania modelu niestandardowego maksymalna liczba stron dla danych szkoleniowych wynosi 500 dla niestandardowego modelu szablonu i 50 000 dla niestandardowego modelu neuronowego.
- W przypadku trenowania niestandardowego modelu wyodrębniania łączny rozmiar danych treningowych wynosi 50 MB dla modelu szablonu i 1 GB dla modelu neuronowego.
- W przypadku trenowania niestandardowego modelu klasyfikacji całkowity rozmiar danych treningowych wynosi 1 GB z maksymalnie 10 000 stron. W przypadku wersji 2024-11-30 (GA) całkowity rozmiar danych treningowych wynosi 2 GB z maksymalnie 10 000 stron.

Wypróbuj wyodrębnianie danych dokumentów hipotecznych

Aby zobaczyć, jak działa wyodrębnianie danych dla usługi dokumentów hipotecznych, potrzebne są następujące zasoby:

Subskrypcja platformy Azure — możesz utworzyć jedną bezpłatnie.
Wystąpienie analizy dokumentów w witrynie Azure Portal. Aby wypróbować usługę, możesz użyć bezpłatnej warstwy cenowej (F0). Po wdrożeniu zasobu wybierz pozycję Przejdź do zasobu , aby uzyskać klucz i punkt końcowy.

Zrzut ekranu przedstawiający klucze i lokalizację punktu końcowego w witrynie Azure Portal.

Document Intelligence Studio

Na stronie głównej Document Intelligence Studio wybierz pozycję Kredyt hipoteczny.
Możesz przeanalizować przykładowe dokumenty hipoteczne lub przekazać własne pliki.
Wybierz przycisk Run analysis (Uruchom analizę), a w razie potrzeby skonfiguruj opcje Analizuj:

Wypróbuj narzędzie Document Intelligence Studio

Obsługiwane języki i ustawienia regionalne

Zobacz naszą stronę Obsługa języków — wstępnie utworzone modele , aby uzyskać pełną listę obsługiwanych języków.

Wyodrębnianie pól

Aby uzyskać informacje o obsługiwanych polach wyodrębniania dokumentów, zobacz strony schematu modelu dokumentów hipotecznych w naszym przykładowym repozytorium GitHub.

Następne kroki

Spróbuj przetwarzać własne formularze i dokumenty za pomocą programu Document Intelligence Studio.
Ukończ przewodnik Szybki start dotyczący analizy dokumentów i rozpocznij tworzenie aplikacji do przetwarzania dokumentów w wybranym języku programowania.

Udostępnij za pośrednictwem