Limity przydziału i limity usługi

Ta zawartość ma zastosowanie do:🟩Wersja 4.0 (ogólna dostępność) | Poprzednie wersje:🟦Wersja 3.1 (ogólna dostępność)🟥Wersja 3.0 (wycofanie)

Ta zawartość ma zastosowanie do:🟥Wersja 2.1 | Najnowsza wersja:🟪Wersja 4.0 (ogólna dostępność)

Ten artykuł zawiera zarówno krótki przegląd, jak i szczegółowy opis usługi Azure Document Intelligence w kontekście limitów i kwot narzędzi Foundry we wszystkich warstwach cenowych. Zawiera również pewne najlepsze rozwiązania, aby uniknąć ograniczania żądań.

Użycie modelu

Limity użycia modelu różnią się w zależności od wersji interfejsu API i warstwy cenowej. Zapoznaj się z obsługiwanymi typami dokumentów i limitami przydziałów usług, które mają zastosowanie do zasobu.

Obsługiwane typy dokumentów

W poniższej tabeli przedstawiono typy dokumentów obsługiwane przez każdy model w interfejsie API w wersji 4.0.

Obsługiwane typy dokumentów Odczytu Układ Wstępnie utworzone modele Modele niestandardowe Możliwości dodatków
PDF ✔️ ✔️ ✔️ ✔️ ✔️
Obrazy: JPEG/JPG, , PNGBMP, , TIFFHEIF ✔️ ✔️ ✔️ ✔️ ✔️
Microsoft Office: DOCX, , PPTXXLS ✔️ ✔️ ✖️ ✖️ ✖️

✔️ = obsługiwane ✖️ = nieobsługiwane

Analiza dokumentów v4.0 2024-11-30 (GA) obsługuje funkcje stron i wierszy z następującymi ograniczeniami:

  • Kąt, szerokość/wysokość i jednostka nie są obsługiwane.
  • Dla każdego wykrytego obiektu wielokąty ograniczające ani obszary ograniczające nie są obsługiwane.
  • Obiekt lines nie jest obsługiwany.

Obsługiwane typy dokumentów

W poniższej tabeli przedstawiono typy dokumentów obsługiwane przez każdy model w interfejsie API w wersji 3.1.

Obsługiwane typy dokumentów Odczytu Układ Wstępnie utworzone modele Modele niestandardowe
PDF ✔️ ✔️ ✔️ ✔️
Obrazy: JPEG/JPG, , PNGBMP, , TIFFHEIF ✔️ ✔️ ✔️ ✔️
Microsoft Office: DOCX, , PPTXXLS ✔️ ✖️ ✖️ ✖️

✔️ = obsługiwane ✖️ = nieobsługiwane

Fakturowanie

Rozliczenia analizy dokumentów są obliczane co miesiąc na podstawie typu modelu i liczby analizowanych stron. Metryki użycia można znaleźć na panelu metryk w portalu Azure. Pulpit wyświetla liczbę stron przetwarzanych przez Azure Document Intelligence. Szacowany koszt wydatków na zasób można sprawdzić przy użyciu kalkulatora cen Azure. Aby uzyskać szczegółowe instrukcje, zobacz Sprawdzanie użycia i szacowania kosztów. Oto kilka szczegółów:

  • Po przesłaniu dokumentu do analizy usługa analizuje wszystkie strony, chyba że określisz zakres stron przy użyciu parametru pages w żądaniu. Gdy usługa analizuje dokumenty Microsoft Excel i PowerPoint za pomocą modelu odczytu, OCR lub układu, zlicza każdy arkusz Excel i PowerPoint slajd jako jedną stronę.

  • Gdy usługa analizuje pliki PDF i TIFF, zlicza każdą stronę w pliku PDF lub każdy obraz w pliku TIFF jako jedną stronę bez maksymalnych limitów znaków.

  • Gdy usługa analizuje pliki Microsoft Word i HTML obsługiwane przez modele odczytu i układu, zlicza strony w blokach o 3000 znaków. Jeśli na przykład dokument zawiera 7000 znaków, dwie strony z 3000 znakami każda i jedna strona z 1000 znakami sumuje się do łącznej liczby trzech stron.

  • Modele odczytu i układu nie obsługują analizy osadzonych lub połączonych obrazów w plikach Microsoft Word, Excel, PowerPoint i HTML. W związku z tym usługa nie zlicza ich jako dodanych obrazów.

  • Trenowanie modelu niestandardowego jest zawsze bezpłatne z Technologią Inteligencji Dokumentów. Opłaty są naliczane tylko wtedy, gdy usługa używa modelu do analizowania dokumentu.

  • Cennik kontenera jest taki sam jak cennik usługi w chmurze.

  • Analiza dokumentów oferuje warstwę bezpłatną (F0), w której można przetestować wszystkie funkcje analizy dokumentów. Darmowa warstwa ogranicza analizowanie odpowiedzi tylko do pierwszych dwóch stron w żądaniu.

  • Document Intelligence ma model cenowy oparty na zobowiązaniach dla dużych obciążeń.

  • Aby wygenerować etykiety dla swojego zestawu danych na potrzeby dopasowanego treningu, wymagany jest model rozmieszczenia. Jeśli zestaw danych używany do trenowania niestandardowego nie ma dostępnych plików etykiet, usługa wygeneruje je dla Ciebie i obciąży Cię za korzystanie z modelu układu.

Limity usług

W poniższej tabeli porównaliśmy limity przydziałów użycia modelu dla warstw cenowych Bezpłatna (F0) i Standardowa (S0).

Limit Bezpłatna (F0)1 Standard (S0)
Analizowanie limitu transakcji na sekundę 1 15 (wartość domyślna)
Regulowane Nie Tak 2
Uzyskaj limit operacji na sekundę 1 50 (wartość domyślna)
Regulowane Nie Tak 2
Limit operacji zarządzania modelami na sekundę 1 5 (wartość domyślna)
Regulowane Nie Tak 2
Limit operacji na liście na sekundę 1 10 (wartość domyślna)
Regulowane Nie Tak 2
Maksymalna liczba zasobów analizy dokumentów na region 1 20
Regulowane Nie Nie
Maksymalny rozmiar dokumentu 4 MB 500 MB
Regulowane Nie Nie
Maksymalna liczba stron (analiza) 2 2000
Regulowane Nie Nie
Maksymalny rozmiar pliku etykiet 10 MB 10 MB
Regulowane Nie Nie
Maksymalny rozmiar odpowiedzi OCR json 500 MB 500 MB
Regulowane Nie Nie
Maksymalna liczba modeli szablonów 500 5000
Regulowane Nie Nie
Maksymalna liczba modeli neuronowych 100 500
Regulowane Nie Nie

Użycie modelu niestandardowego

Limit Bezpłatna (F0) 1 Standard (S0)
Limit modelu tworzenia 5 500 (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych treningowych * sieci neuronowe i modele generatywne 1 GB 3 1 GB (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * Szablon 50 MB 4 50 MB (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba stron (trenowanie) * szablon 500 500 (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba stron (szkolenie) * neuronowe i generatywne 50,000 50 000 (wartość domyślna)
Regulowane Nie Nie
Trenowanie niestandardowego modelu neuronowego 10 godzin miesięcznie 5 brak limitu (płatność według godziny), zacznij od 10 bezpłatnych godzin każdego miesiąca
Regulowane Nie Tak 3
Maksymalna liczba stron (trenowanie) * Klasyfikator 25,000 25 000 (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba typów dokumentów (klas) * Klasyfikator 1000 1000 (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * Klasyfikator 1 GB 2 GB (wartość domyślna)
Regulowane Nie Nie
Minimalna liczba próbek na klasę * Klasyfikator 5 5 (wartość domyślna)
Regulowane Nie Nie

Użycie modelu niestandardowego

Limit Bezpłatna (F0) 1 Standard (S0)
Limit modelu tworzenia 5 200 (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * neuronowy 1 GB 3 1 GB (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * Szablon 50 MB 4 50 MB (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba stron (trenowanie) * szablon 500 500 (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba stron (trenowanie) * neuronowe 50,000 50 000 (wartość domyślna)
Regulowane Nie Nie
Trenowanie niestandardowego modelu neuronowego 10 miesięcznie 20 miesięcznie
Regulowane Nie Tak 3
Maksymalna liczba stron (trenowanie) * Klasyfikator 10 000 10 000 (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba typów dokumentów (klas) * Klasyfikator 500 500 (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * Klasyfikator 1 GB 1 GB (wartość domyślna)
Regulowane Nie Nie
Minimalna liczba próbek na klasę * Klasyfikator 5 5 (wartość domyślna)
Regulowane Nie Nie

Użycie modelu niestandardowego

Limit Bezpłatna (F0) 1 Standard (S0)
Limit modelu tworzenia 5 200 (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * neuronowy 1 GB 3 1 GB (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * Szablon 50 MB 4 50 MB (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba stron (trenowanie) * szablon 500 500 (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba stron (trenowanie) * neuronowe 50,000 50 000 (wartość domyślna)
Regulowane Nie Nie
Trenowanie niestandardowego modelu neuronowego 10 miesięcznie 20 miesięcznie
Regulowane Nie Tak 3
Maksymalna liczba stron (trenowanie) * Klasyfikator 10 000 10 000 (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba typów dokumentów (klas) * Klasyfikator 500 500 (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania * Klasyfikator 1 GB 1 GB (wartość domyślna)
Regulowane Nie Nie
Minimalna liczba próbek na klasę * Klasyfikator 5 5 (wartość domyślna)
Regulowane Nie Nie

Limity modelu niestandardowego

Limit Bezpłatna (F0) 1 Standard (S0)
Limit modelu tworzenia 5 200 (wartość domyślna)
Regulowane Nie Nie
Rozmiar zestawu danych trenowania 50 MB 50 MB (wartość domyślna)
Regulowane Nie Nie
Maksymalna liczba stron (trenowanie) 500 500 (wartość domyślna)
Regulowane Nie Nie

1 W przypadku poziomu cenowego Bezpłatna (F0) zobacz również miesięczne limity na stronie z cennikiem.
2 Zobacz najlepsze praktyki i instrukcje dotyczące korekt.
3 Liczba szkoleń modeli neuronowych jest resetowana co miesiąc kalendarzowy. Otwórz wniosek o pomoc techniczną, aby zwiększyć miesięczny limit trenowania. Począwszy od interfejsu API w wersji 4.0, żądania trenowania przekraczające 20 żądań w miesiącu kalendarzowym są rozliczane na poziomie szkoleniowym. Aby uzyskać szczegółowe informacje, zobacz cennik .

4 Ten limit dotyczy wszystkich dokumentów znajdujących się w folderze zestawu danych szkoleniowych przed wszelkimi aktualizacjami związanymi z etykietowaniem.

5 Ten limit dotyczy v 4.0 (2024-11-30 GA) tylko niestandardowych modeli neuronowych. Począwszy od v 4.0, oferujemy możliwość trenowania większych dokumentów przez dłuższy czas (do 10 godzin za darmo, a po tym naliczane są opłaty). Aby uzyskać więcej informacji, odwiedź stronę modelu neuronowego dostosowanego do potrzeb.

Szczegółowy opis, korekta limitu przydziału i najlepsze rozwiązania

Limity domyślne można rozszerzyć, składając wniosek o zwiększenie za pośrednictwem zgłoszenia do pomocy technicznej. Przed zażądaniem zwiększenia limitu przydziału (jeśli ma to zastosowanie), upewnij się, że jest to konieczne.

Jeśli aplikacja zwraca kod odpowiedzi 429 (zbyt wiele żądań), przekracza próg dla co najmniej jednego limitu transakcji na sekundę (TPS):

  • Analizowanie limitu transakcji na sekundę Moduł TPS do przesyłania żądań analizy (POST)
  • Limit operacji GET na sekundę Limity TPS dotyczące sondowania wyników operacji analizy (GET)
  • Operacje zarządzania modelami - limit na sekundę Operacje związane z zarządzaniem modelami, np. budowaniem/trenowaniem i kopiowaniem.
  • Limit operacji listowania na sekundę Operacje związane z listowaniem modeli, operacji.

Ogólne najlepsze rozwiązania dotyczące ograniczania przepustowości

Aby zminimalizować problemy związane z ograniczaniem przepustowości (kod odpowiedzi 429), zalecamy użycie następujących technik:

  • Implementowanie logiki ponawiania prób w aplikacji
  • Unikaj gwałtownych zmian w obciążeniu. Stopniowe zwiększanie obciążenia
    Przykład. Aplikacja korzysta z analizy dokumentów, a bieżące obciążenie to 10 TPS (transakcje na sekundę). W następnej sekundzie zwiększasz obciążenie do 40 TPS. Wynikiem jest kod odpowiedzi 429 dla niektórych żądań, ponieważ przekraczasz limit 15 TPS przy przesyłaniu operacji analizy. Możesz ograniczyć przetwarzanie, aby pozostać w ramach 15 TPS, lub poprosić o zwiększenie TPS w celu obsługi większych woluminów.

W następnych sekcjach opisano konkretne przypadki dostosowywania limitów przydziału. Przechodzenie do analizy dokumentów: zwiększanie limitu żądań współbieżnych

Zwiększanie liczby transakcji na sekundę limitu żądań

Domyślnie liczba transakcji na sekundę jest ograniczona do 15 transakcji na sekundę dla zasobu analizy dokumentów. Dla warstwy cenowej Standard można przesłać żądania zwiększenia TPS, ale to, czy mogą być zatwierdzone i na jakim poziomie TPS, będzie zależeć od wzorców dziennego użycia i najlepszych praktyk, jakie są wdrażane. Przed przesłaniem żądania upewnij się, że znasz materiał w tej sekcji i zapoznasz się z tymi najlepszymi rozwiązaniami.

Zwiększenie limitu żądań współbieżnych nie ma bezpośredniego wpływu na koszty. Usługa Analizy dokumentów używa modelu "Płatność tylko za to, czego używasz". Limit określa, do jakiego poziomu usługa może się skalować przed rozpoczęciem ograniczania prędkości przetwarzania twoich żądań.

Istniejąca wartość różnych kategorii limitów żądań jest dostępna za pośrednictwem portalu Azure w bloku przeglądu zasobów na karcie monitorowanie.

Tworzenie i przesyłanie wniosku o pomoc techniczną dla zwiększenia tpS

Zainicjuj zwiększenie limitu transakcji na sekundę (TPS) dla zasobu, przesyłając wniosek o pomoc techniczną:

  • Zaloguj się do portalu Azure
  • Wybierz zasób analizy dokumentów, dla którego chcesz zwiększyć limit TPS
  • Wybierz -Nowe żądanie pomocy technicznej- (-Support + rozwiązywanie problemów- grupa). Zostanie wyświetlone nowe okno z automatycznie wypełnionymi informacjami o subskrypcji Azure i zasobie Azure
  • Wprowadź -Podsumowanie- (na przykład "Zwiększ limit TPS Inteligencji Dokumentu")
  • W polu Typ problemu wybierz pozycję "Weryfikacja przydziału lub użycia".
  • Wybierz pozycję -Next: Solutions- (Dalej: rozwiązania)
  • Kontynuuj tworzenie żądania
  • Wprowadź następujące informacje w polu -Description- na karcie Szczegóły:
    • zwróć uwagę, że żądanie dotyczy limitu analizy dokumentów.
    • Podaj oczekiwanie dotyczące TPS, do którego chcesz się dostosować. Chociaż zwiększenie TPS jest bezpłatne, należy żądać tylko takiego wzrostu TPS, który jest rozsądny dla obciążenia.
    • informacje o zasobach Azure
    • Wypełnij wprowadzanie wymaganych informacji i wybierz przycisk -Create- w -Review + create-tab
    • Zanotuj numer żądania pomocy technicznej w powiadomieniach w portalu Azure. Oczekuj, że wsparcie skontaktuje się z Tobą wkrótce w celu dalszego przetwarzania.

Przykład najlepszych rozwiązań dotyczących wzorca obciążenia

W tym przykładzie przedstawiamy podejście, które zalecamy dla złagodzenia potencjalnego ograniczania żądań. Nie jest to dokładny przepis, ale tylko szablon, który zachęcamy do naśladowania i dostosowywania w razie potrzeby.

Załóżmy, że zasób analizy dokumentów ma ustawiony domyślny limit. Uruchom zadanie, aby przesłać żądania analiz. Jeśli okaże się, że podczas sprawdzania ukończenia występuje częste ograniczanie przepustowości z kodem odpowiedzi 429, rozpocznij od zaimplementowania wykładniczego wycofywania w żądaniu analizy GET. Używając stopniowo dłuższego czasu oczekiwania między kolejnymi próbami odpowiedzi na błędy, na przykład wzorzec 2-5-13-34 opóźnień między żądaniami. Ogólnie rzecz biorąc, zalecamy nie wywoływanie odpowiedzi get analyze więcej niż raz co 2 sekundy dla odpowiedniego żądania POST. analyze Odpowiedź zawiera również nagłówek retry-after, który wskazuje, ile sekund należy odczekać przed sprawdzeniem zakończenia tego żądania.

Jeśli okaże się, że ograniczana jest liczba żądań POST dla dokumentów przesyłanych do systemu, rozważ dodanie opóźnienia między żądaniami. Jeśli obciążenie wymaga wyższego stopnia przetwarzania współbieżnego, należy utworzyć wniosek o pomoc techniczną, aby zwiększyć limity usług dla transakcji na sekundę.

Ogólnie rzecz biorąc, zalecamy przetestowanie obciążenia i wzorców obciążenia przed przejściem do środowiska produkcyjnego.

Następne kroki