Dienstkontingente und Grenzwerte

Dieser Inhalt gilt für:🟩v4.0 (GA) | Frühere Versionen:🟦v3.1 (GA)🟥v3.0 (wird eingestellt)

Dieser Inhalt gilt für:🟥v2.1 | Neueste Version:🟪v4.0 (GA)

Dieser Artikel enthält eine Kurzübersicht und eine ausführliche Beschreibung der Kontingente und Grenzwerte für den Azure Document Intelligence in Foundry Tools für alle Tarife. Es enthält auch einige bewährte Methoden, um eine Anforderungsdrosselung zu vermeiden.

Modellnutzung

Unterstützte Dokumenttypen Lesen Gestaltung Vorgefertigte Modelle Benutzerdefinierte Modelle Erweiterungsfunktionen
PDF ✔️ ✔️ ✔️ ✔️ ✔️
Bilder: JPEG/JPG, , PNGBMP, TIFFHEIF ✔️ ✔️ ✔️ ✔️ ✔️
Microsoft Office: DOCX, PPTXXLS ✔️ ✔️ ✖️ ✖️ ✖️

✔️ = unterstützt ✖️ = Nicht unterstützt

Für Dokument Intelligenz v4.0 unterstützt 2024-11-30 (allgemein verfügbar) Seiten- und Zeilenfeatures mit den folgenden Einschränkungen:

  • Winkel, Breite/Höhe und Einheit werden nicht unterstützt.
  • Für die einzelnen erkannten Objekte werden Begrenzungspolygone und Begrenzungsbereiche nicht unterstützt.
  • Das lines Objekt wird nicht unterstützt.
Unterstützte Dokumenttypen Lesen Gestaltung Vorgefertigte Modelle Benutzerdefinierte Modelle
PDF ✔️ ✔️ ✔️ ✔️
Bilder: JPEG/JPG, , PNGBMP, TIFFHEIF ✔️ ✔️ ✔️ ✔️
Microsoft Office: DOCX, PPTXXLS ✔️ ✖️ ✖️ ✖️

✔️ = unterstützt ✖️ = Nicht unterstützt

Abrechnung

Die Abrechnung von Document Intelligence wird monatlich basierend auf dem Modelltyp und der Anzahl der analysierten Seiten berechnet. Im Azure-Portal finden Sie Nutzungsmetriken im Metrik-Dashboard. Das Dashboard zeigt, wie viele Seiten von Azure Document Intelligence verarbeitet werden. Mithilfe des Azure Preisrechners können Sie die für die Ressource aufgewendeten geschätzten Kosten überprüfen. Ausführliche Anweisungen finden Sie unter Überprüfen der Nutzungs- und Kostenschätzung. Hier sind einige Details:

  • Wenn Sie ein Dokument zur Analyse übermitteln, analysiert der Dienst alle Seiten, es sei denn, Sie geben einen Seitenbereich mithilfe des pages Parameters in Ihrer Anforderung an. Wenn der Dienst Microsoft Excel und PowerPoint Dokumente über das Lese-, OCR- oder Layoutmodell analysiert, zählt er jedes Excel Arbeitsblatt und PowerPoint Folie als eine Seite.

  • Wenn der Dienst PDF- und TIFF-Dateien analysiert, zählt er jede Seite in der PDF-Datei oder jedes Bild in der TIFF-Datei als eine Seite ohne maximale Zeichenbeschränkungen.

  • Wenn der Dienst Microsoft Word- und HTML-Dateien analysiert, die von den Lese- und Layoutmodellen unterstützt werden, zählt er Seiten in Blöcken von jeweils 3.000 Zeichen. Wenn Ihr Dokument beispielsweise 7.000 Zeichen enthält, addieren sich die beiden Seiten mit jeweils 3.000 Zeichen und einer Seite mit 1.000 Zeichen zu insgesamt drei Seiten.

  • Die Lese- und Layoutmodelle unterstützen keine Analyse eingebetteter oder verknüpfter Bilder in Microsoft Word-, Excel-, PowerPoint- und HTML-Dateien. Daher zählt der Dienst sie nicht als hinzugefügte Bilder.

  • Das Training eines benutzerdefinierten Modells ist immer kostenlos mit Document Intelligence. Gebühren entstehen nur, wenn der Dienst ein Modell zum Analysieren eines Dokuments verwendet.

  • Containerpreise entsprechen den Preisen für Clouddienste.

  • Document Intelligence bietet eine kostenlose Ebene (F0), in der Sie alle Dokumentintelligenzfeatures testen können. Die kostenlose Stufe beschränkt die Analyseantwort auf nur die ersten beiden Seiten einer Anfrage.

  • Document Intelligence verfügt über ein verpflichtungsbasiertes Preismodell für große Workloads.

  • Das Layoutmodell ist erforderlich, um Bezeichnungen für Ihr Dataset für benutzerdefinierte Schulungen zu generieren. Wenn für das Dataset, das Sie für benutzerdefinierte Schulungen verwenden, keine Bezeichnungsdateien verfügbar sind, generiert der Dienst sie für Sie und berechnet Sie für die Layoutmodellverwendung.

Kontingent Kostenlos (F0)1 Standard (S0)
Analyse des Transaktionen-pro-Sekunde-Limits 1 15 (Standardwert)
Einstellbar Nein Ja 2
Limit für Abrufvorgänge pro Sekunde 1 50 (Standardwert)
Einstellbar Nein Ja 2
Grenzwert für Modellverwaltungsvorgänge pro Sekunde 1 5 (Standardwert)
Einstellbar Nein Ja 2
Grenze für Listenvorgänge pro Sekunde 1 10 (Standardwert)
Einstellbar Nein Ja 2
Maximale Dokumentgröße 4 MB 500 MB
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Analyse) 2 2000
Einstellbar Nein Nein
Maximale Größe der Bezeichnungsdatei 10 MB 10 MB
Einstellbar Nein Nein
Maximale Größe der OCR-JSON-Antwort 500 MB 500 MB
Einstellbar Nein Nein
Maximale Anzahl von Vorlagenmodellen 500 5000
Einstellbar Nein Nein
Max. Anzahl neuraler Modelle 100 500
Einstellbar Nein Nein

Benutzerdefinierte Modellverwendung

Kontingent Kostenlos (F0) 1 Standard (S0)
Begrenzung des Compose-Modells 5 500 (Standardwert)
Einstellbar Nein Nein
Größe des Training-Datasets * Neural und Generativ 1 GB 3 1 GB (Standardwert)
Einstellbar Nein Nein
Größe des Schulungsdatensatzes * Vorlage 50 MB 4 50 MB (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Schulung) * Vorlage 500 500 (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Schulung) * Neurale und generative 50,000 50.000 (Standardwert)
Einstellbar Nein Nein
Benutzerdefiniertes neurales Modell trainieren 10 Stunden pro Monat 5 Keine Begrenzung (Bezahlung nach Stunde), beginnen Sie jeden Monat mit 10 kostenlosen Stunden.
Einstellbar Nein Ja 3
Maximale Anzahl von Seiten (Schulung) * Klassifizierer 25,000 25.000 (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Dokumenttypen (Klassen) * Klassifizierer 1000 1000 (Standardwert)
Einstellbar Nein Nein
Schulungsdatensatzgröße * Klassifizierer 1GB 2 GB (Standardwert)
Einstellbar Nein Nein
Min. Anzahl der Beispiele pro Klasse * Klassifizierer 5 5 (Standardwert)
Einstellbar Nein Nein

Benutzerdefinierte Modellverwendung

Kontingent Kostenlos (F0) 1 Standard (S0)
Begrenzung des Compose-Modells 5 200 (Standardwert)
Einstellbar Nein Nein
Trainingsdatensatzgröße * Neural 1 GB 3 1 GB (Standardwert)
Einstellbar Nein Nein
Größe des Schulungsdatensatzes * Vorlage 50 MB 4 50 MB (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Schulung) * Vorlage 500 500 (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Schulung) * Neural 50,000 50.000 (Standardwert)
Einstellbar Nein Nein
Benutzerdefiniertes neurales Modell trainieren 10 pro Monat 20 pro Monat
Einstellbar Nein Ja 3
Maximale Anzahl von Seiten (Schulung) * Klassifizierer 10.000 10.000 (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Dokumenttypen (Klassen) * Klassifizierer 500 500 (Standardwert)
Einstellbar Nein Nein
Schulungsdatensatzgröße * Klassifizierer 1GB 1 GB (Standardwert)
Einstellbar Nein Nein
Min. Anzahl der Beispiele pro Klasse * Klassifizierer 5 5 (Standardwert)
Einstellbar Nein Nein

Benutzerdefinierte Modellverwendung

Kontingent Kostenlos (F0) 1 Standard (S0)
Begrenzung des Compose-Modells 5 200 (Standardwert)
Einstellbar Nein Nein
Trainingsdatensatzgröße * Neural 1 GB 3 1 GB (Standardwert)
Einstellbar Nein Nein
Größe des Schulungsdatensatzes * Vorlage 50 MB 4 50 MB (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Schulung) * Vorlage 500 500 (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Schulung) * Neural 50,000 50.000 (Standardwert)
Einstellbar Nein Nein
Benutzerdefiniertes neurales Modell trainieren 10 pro Monat 20 pro Monat
Einstellbar Nein Ja 3
Maximale Anzahl von Seiten (Schulung) * Klassifizierer 10.000 10.000 (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Dokumenttypen (Klassen) * Klassifizierer 500 500 (Standardwert)
Einstellbar Nein Nein
Schulungsdatensatzgröße * Klassifizierer 1GB 1 GB (Standardwert)
Einstellbar Nein Nein
Min. Anzahl der Beispiele pro Klasse * Klassifizierer 5 5 (Standardwert)
Einstellbar Nein Nein

Grenzwerte für benutzerdefinierte Modelle

Kontingent Kostenlos (F0) 1 Standard (S0)
Begrenzung des Compose-Modells 5 200 (Standardwert)
Einstellbar Nein Nein
Größe des Schulungsdatensatzes 50 MB 50 MB (Standardwert)
Einstellbar Nein Nein
Maximale Anzahl von Seiten (Schulung) 500 500 (Standardwert)
Einstellbar Nein Nein

1 Für die kostenlose (F0) Preisstufe siehe auch monatliche Kontingente auf der Preisseite.
2 Siehe bewährte Methoden und Anpassungsanweisungen.
3 Die Anzahl der Trainings von neuronalen Modellen wird jeden Kalendermonat zurückgesetzt. Öffnen Sie eine Supportanfrage, um den monatlichen Schulungsgrenzwert zu erhöhen. Ab der v4.0 API werden Trainingsanfragen mit mehr als 20 Anfragen in einem Kalendermonat auf dem Training Tier abgerechnet. Details finden Sie unter "Preise ".

4 Dieser Grenzwert gilt für alle Dokumente, die in Ihrem Schulungsdatensatzordner vor allen bezeichnungsbezogenen Updates gefunden wurden.

5 Dieser Grenzwert gilt nur für v 4.0 (2024-11-30 GA) benutzerdefinierte neurale Modelle. Ab v 4.0 unterstützen wir das Training größerer Dokumente für längere Zeiträume (bis zu 10 Stunden kostenlos, danach fallen Belastungen an). Weitere Informationen finden Sie auf der benutzerdefinierten neuralen Modellseite.

Detaillierte Beschreibung, Kontingentanpassung und bewährte Methoden

Die Standardgrenzwerte können durch Anfordern einer Erhöhung über ein Supportticket verlängert werden. Stellen Sie vor dem Anfordern einer Kontingenterhöhung (sofern zutreffend) sicher, dass sie erforderlich ist.

Wenn Ihre Anwendung Den Antwortcode 429 (Zu viele Anforderungen) zurückgibt, überschreiten Sie den Schwellenwert für mindestens eine der Transaktionen pro Sekunde (TPS):

  • Analyse-Transaktionslimit pro Sekunde Das TPS für das Übermitteln von Analyseanforderungen (POST)
  • Limit für Abrufvorgänge pro Sekunde Die TPS für die Abfrage von Ergebnissen bei Analysevorgängen (GET)
  • Modellverwaltungsvorgänge pro Sekunde Vorgänge im Zusammenhang mit der Modellverwaltung, wie Erstellen/Trainieren und Kopieren.
  • Auflisten-Vorgänge pro Sekunde Limit Vorgänge im Zusammenhang mit dem Auflisten von Modellen, Vorgängen.

Allgemeine bewährte Methoden zur Vermeidung von Drosselung

Um Probleme im Zusammenhang mit der Drosselung zu minimieren (Antwortcode 429), empfehlen wir die Verwendung der folgenden Techniken:

  • Implementieren der Wiederholungslogik in Ihrer Anwendung
  • Vermeiden Sie scharfe Änderungen an der Arbeitsauslastung. Schrittweises Erhöhen der Arbeitsauslastung
    Beispiel. Ihre Anwendung verwendet Document Intelligence, und Ihre aktuelle Arbeitsauslastung beträgt 10 TPS (Transaktionen pro Sekunde). Die nächste Sekunde erhöhen Sie die Last auf 40 TPS. Das Ergebnis ist ein 429-Antwortcode für einige Anfragen, da Sie das Limit von 15 TPS für das Einreichen von Analysevorgängen überschreiten. Sie könnten die Verarbeitung entweder wieder deaktivieren, um unter den 15 TPS zu bleiben, oder eine Erhöhung des TPS anfordern, um Ihre höheren Volumes zu unterstützen.

In den nächsten Abschnitten werden bestimmte Fälle der Anpassung von Kontingenten beschrieben. Zu Dokumentintelligenz springen: Erhöhen des Grenzwerts für gleichzeitige Anforderungen

Erhöhen des Anforderungsgrenzwerts für Transaktionen pro Sekunde

Die Anzahl der Transaktionen pro Sekunde ist standardmäßig auf 15 Transaktionen pro Sekunde für eine Document Intelligence-Ressource beschränkt. Für die Standard-Preisstufe können Anfragen zur Erhöhung der TPS übermittelt werden. Ob diese genehmigt werden können und welche Anpassung der TPS-Ebene möglich ist, hängt von den täglichen Nutzungsmustern und den befolgten bewährten Methoden ab. Stellen Sie vor der Übermittlung der Anforderung sicher, dass Sie mit dem Material in diesem Abschnitt vertraut sind und diese bewährten Methoden kennen.

Das Erhöhen des Grenzwerts für gleichzeitige Anforderungen wirkt sich nicht direkt auf Ihre Kosten aus. Der Dokumentintelligenzdienst verwendet das Modell "Nur bezahlen für das, was Sie verwenden". Der Grenzwert gibt an, wie hoch der Dienst skaliert werden kann, bevor Ihre Anforderungen gedrosselt werden.

Der vorhandene Wert verschiedener Anforderungsgrenzkategorien ist über Azure Portal unter der Registerkarte "Überwachung" auf dem Blatt "Ressourcenübersicht" verfügbar.

Supportanfrage zur TPS-Erhöhung erstellen und einreichen

Initiieren Sie die Erhöhung der Transaktionen pro Sekunde(TPS)-Grenzwert für Ihre Ressource, indem Sie die Supportanfrage übermitteln:

  • Melden Sie sich beim portal Azure
  • Wählen Sie die Document Intelligence-Ressource aus, für die Sie den TPS-Grenzwert erhöhen möchten.
  • Wählen Sie die Option -Neue Supportanfrage- (-Support- und Problembehandlungsgruppe-) aus. Ein neues Fenster wird mit automatisch ausgefüllten Informationen zu Ihrem Azure-Abonnement und Azure Ressource angezeigt.
  • Geben Sie -Zusammenfassung- ein (wie "Erhöhen des TPS-Limits für Dokumentenintelligenz")
  • Wählen Sie "Kontingent- oder Verwendungsüberprüfung" für das Problemtypfeld aus.
  • Wählen Sie -Weiter: Lösungen-
  • Fahren Sie mit der Anforderungserstellung fort.
  • Geben Sie die folgenden Informationen im Feld "-Beschreibung" unter der Registerkarte "Details" ein:
    • Beachten Sie, dass die Anfrage das Dokumentintelligenzkontingent betrifft.
    • Geben Sie eine TPS-Erwartung an, auf die Sie skalieren möchten. Während TPS-Erhöhungen kostenlos sind, sollten Sie nur einen TPS anfordern, der für Ihre Arbeitsauslastung angemessen ist.
    • Azure Ressourceninformationen
    • Schließen Sie die Eingabe der erforderlichen Informationen ab und wählen Sie die Schaltfläche „Erstellen“ im Tab „Prüfen + Erstellen“ aus.
    • Notieren Sie sich die Supportanfragenummer in Azure Portalbenachrichtigungen. Erwarten Sie, dass der Support Sie in Kürze kontaktiert, um die weitere Bearbeitung fortzusetzen.

Beispiel für bewährte Methoden für ein Arbeitsauslastungsmuster

In diesem Beispiel ist ein Ansatz vorhanden, den wir empfehlen, um eine mögliche Drosselung von Anfragen zu beheben. Es ist kein genaues Rezept, sondern nur eine Vorlage, die wir einladen, nach Bedarf zu folgen und anzupassen.

Angenommen, eine Document Intelligence-Ressource hat den Standardgrenzwert festgelegt. Starten Sie die Workload, um Ihre Analyseanforderungen zu übermitteln. Wenn Sie feststellen, dass bei der Überprüfung des Abschlusses eine häufige Drosselung mit dem Antwortcode 429 auftritt, sollten Sie zunächst ein exponentielles Backoff für die Antwortanforderung „GET analyze“ implementieren. Durch die Verwendung einer schrittweise längeren Wartezeit zwischen Wiederholungsversuchen für aufeinanderfolgende Fehlerantworten, wie zum Beispiel ein 2-5-13-34-Muster von Verzögerungen zwischen den Anfragen. Im Allgemeinen wird empfohlen, die Get-Analyseantwort nicht mehr als einmal alle 2 Sekunden für eine entsprechende POST-Anforderung aufzurufen. Die analyze-Antwort enthält außerdem einen retry-after-Header, der angibt, wie lange in Sekunden gewartet werden sollte, bevor geprüft wird, ob die Anfrage abgeschlossen ist.

Wenn Sie feststellen, dass die Anzahl der POST-Anforderungen für übermittelte Dokumente gedrosselt wird, sollten Sie eine Verzögerung zwischen den Anforderungen hinzufügen. Wenn Ihre Workload ein höheres Maß an gleichzeitiger Verarbeitung erfordert, müssen Sie eine Supportanfrage erstellen, um Ihre Dienstgrenzwerte für Transaktionen pro Sekunde zu erhöhen.

Im Allgemeinen empfehlen wir, die Arbeitslast und die Arbeitslastmuster zu testen, bevor Sie in den produktiven Betrieb übergehen.

Nächste Schritte