Quote e limiti del servizio

Questo contenuto si applica a:🟩v4.0 (GA) | Versioni precedenti:🟦v3.1 (GA)🟥v3.0 (ritiro)

Questo contenuto si applica a:🟥v2.1 | Ultima versione:🟪v4.0 (GA)

Questo articolo contiene sia un riferimento rapido che una descrizione dettagliata di Azure Document Intelligence nelle quote e limiti degli strumenti Foundry per tutti i livelli di prezzo. Contiene inoltre alcune procedure consigliate per evitare la limitazione delle richieste.

Utilizzo del modello

Tipi di documento supportati Leggere Struttura Modelli predefiniti Modelli personalizzati Funzionalità dei componenti aggiuntivi
PDF ✔️ ✔️ ✔️ ✔️ ✔️
Immagini: JPEG/JPG, PNG, BMP, TIFF, HEIF ✔️ ✔️ ✔️ ✔️ ✔️
Microsoft Office: DOCX, PPTX,XLS ✔️ ✔️ ✖️ ✖️ ✖️

✔️ = supportato ✖️ = Non supportato

Per Document Intelligence v4.0 2024-11-30 (GA) supporta le funzionalità di pagina e riga con le restrizioni seguenti:

  • Angolo, larghezza/altezza e unità non sono supportati.
  • Per ogni oggetto rilevato, i poligoni di delimitazione o le aree di delimitazione non sono supportati.
  • L'oggetto lines non è supportato.
Tipi di documento supportati Leggere Struttura Modelli predefiniti Modelli personalizzati
PDF ✔️ ✔️ ✔️ ✔️
Immagini: JPEG/JPG, PNG, BMP, TIFF, HEIF ✔️ ✔️ ✔️ ✔️
Microsoft Office: DOCX, PPTX,XLS ✔️ ✖️ ✖️ ✖️

✔️ = supportato ✖️ = Non supportato

Fatturazione

La fatturazione di Document Intelligence viene calcolata mensilmente in base al tipo di modello e al numero di pagine analizzate. È possibile trovare le metriche di utilizzo nel dashboard delle metriche nel portale di Azure. Il dashboard visualizza il numero di pagine che Azure Document Intelligence elabora. È possibile controllare il costo stimato speso per la risorsa usando il calcolatore prezzi Azure. Per istruzioni dettagliate, vedere Controllare l'utilizzo e stimare i costi. Ecco alcuni dettagli:

  • Quando si invia un documento per l'analisi, il servizio analizza tutte le pagine a meno che non si specifichi un intervallo di pagine usando il pages parametro nella richiesta. Quando il servizio analizza i documenti di Microsoft Excel e PowerPoint usando il modello di lettura, OCR o layout, ogni foglio di lavoro di Excel e ogni diapositiva di PowerPoint vengono contati come una pagina.

  • Quando il servizio analizza i file PDF e TIFF, conta ogni pagina nel file PDF o ogni immagine nel file TIFF come una pagina senza limiti massimi di caratteri.

  • Quando il servizio analizza Microsoft Word e i file HTML supportati dai modelli di lettura e layout, conta le pagine in blocchi di 3.000 caratteri ciascuno. Ad esempio, se il documento contiene 7.000 caratteri, le due pagine con 3.000 caratteri ciascuno e una pagina con 1.000 caratteri sommano fino a un totale di tre pagine.

  • I modelli di lettura e layout non supportano l'analisi di immagini incorporate o collegate in Microsoft Word, Excel, PowerPoint e file HTML. Di conseguenza, il servizio non li conta come immagini aggiunte.

  • Il training di un modello personalizzato è sempre gratuito con Document Intelligence. Gli addebiti vengono addebitati solo quando il servizio usa un modello per analizzare un documento.

  • I prezzi dei contenitori corrispondono ai prezzi dei servizi cloud.

  • Document Intelligence offre un livello gratuito (F0) in cui è possibile testare tutte le funzionalità di Intelligence per i documenti. I limiti del livello gratuito analizzano la risposta solo alle prime due pagine di una richiesta.

  • Document Intelligence ha un modello di determinazione dei prezzi basato sull'impegno per carichi di lavoro di grandi dimensioni.

  • Il modello Layout è necessario per generare etichette per il set di dati per il training personalizzato. Se il set di dati usato per il training personalizzato non dispone di file di etichetta disponibili, il servizio li genera automaticamente e fattura l'utilizzo del modello di layout.

Quota Gratuito (F0)1 Standard (S0)
Analizzare il limite di transazioni al secondo 1 15 (valore predefinito)
Regolabile No 2
Limite di operazioni Get al secondo 1 50 (valore predefinito)
Regolabile No 2
Limite di operazioni di gestione dei modelli al secondo 1 5 (valore predefinito)
Regolabile No 2
Limite di operazioni di elenco al secondo 1 10 (valore predefinito)
Regolabile No 2
Dimensione massima del documento 4 MB 500 MB
Regolabile No No
Numero massimo di pagine (analisi) 2 2000
Regolabile No No
Dimensioni massime del file di etichette 10 MB 10 MB
Regolabile No No
Dimensioni massime della risposta JSON OCR 500 MB 500 MB
Regolabile No No
Numero massimo di modelli template 500 5000
Regolabile No No
Numero massimo di modelli neurali 100 500
Regolabile No No

Utilizzo del modello personalizzato

Quota Gratuito (F0) 1 Standard (S0)
Limite del modello Compose 5 500 (valore predefinito)
Regolabile No No
Dimensioni del set di dati di training * neurali e generativi 1 GB 3 1 GB (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Modello 50 MB 4 50 MB (valore predefinito)
Regolabile No No
Numero massimo di pagine (training) * Modello 500 500 (valore predefinito)
Regolabile No No
Numero massimo di pagine (formazione) * Neurale e Generativa 50,000 50.000 (valore predefinito)
Regolabile No No
Addestramento del modello neurale personalizzato 10 ore al mese 5 nessun limite (pagamento in base all'ora), iniziare con 10 ore gratuite ogni mese
Regolabile No 3
Numero massimo di pagine (Addestramento) * Classificatore 25,000 25.000 (valore predefinito)
Regolabile No No
Numero massimo di tipi di documento (classi) * Classificatore 1000 1000 (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Classificatore 1 GB 2 GB (valore predefinito)
Regolabile No No
Numero minimo di campioni per classe * Classificatore 5 5 (valore predefinito)
Regolabile No No

Utilizzo del modello personalizzato

Quota Gratuito (F0) 1 Standard (S0)
Limite del modello Compose 5 200 (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Neural 1 GB 3 1 GB (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Modello 50 MB 4 50 MB (valore predefinito)
Regolabile No No
Numero massimo di pagine (training) * Modello 500 500 (valore predefinito)
Regolabile No No
Numero massimo di pagine (Formazione) * Neural 50,000 50.000 (valore predefinito)
Regolabile No No
Addestramento del modello neurale personalizzato 10 al mese 20 al mese
Regolabile No 3
Numero massimo di pagine (Addestramento) * Classificatore 10.000 10.000 (valore predefinito)
Regolabile No No
Numero massimo di tipi di documento (classi) * Classificatore 500 500 (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Classificatore 1 GB 1 GB (valore predefinito)
Regolabile No No
Numero minimo di campioni per classe * Classificatore 5 5 (valore predefinito)
Regolabile No No

Utilizzo del modello personalizzato

Quota Gratuito (F0) 1 Standard (S0)
Limite del modello Compose 5 200 (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Neural 1 GB 3 1 GB (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Modello 50 MB 4 50 MB (valore predefinito)
Regolabile No No
Numero massimo di pagine (training) * Modello 500 500 (valore predefinito)
Regolabile No No
Numero massimo di pagine (Formazione) * Neural 50,000 50.000 (valore predefinito)
Regolabile No No
Addestramento del modello neurale personalizzato 10 al mese 20 al mese
Regolabile No 3
Numero massimo di pagine (Addestramento) * Classificatore 10.000 10.000 (valore predefinito)
Regolabile No No
Numero massimo di tipi di documento (classi) * Classificatore 500 500 (valore predefinito)
Regolabile No No
Dimensioni del set di dati di addestramento * Classificatore 1 GB 1 GB (valore predefinito)
Regolabile No No
Numero minimo di campioni per classe * Classificatore 5 5 (valore predefinito)
Regolabile No No

Limiti del modello personalizzato

Quota Gratuito (F0) 1 Standard (S0)
Limite del modello Compose 5 200 (valore predefinito)
Regolabile No No
Dimensioni del set di dati di training 50 MB 50 MB (valore predefinito)
Regolabile No No
Numero massimo di pagine (training) 500 500 (valore predefinito)
Regolabile No No

1 Per il piano tariffario Gratuito (F0), vedere anche indennità mensili nella pagina dei prezzi.
2 Vederele procedure consigliate e le istruzioni di rettifica.
3 Il numero di training dei modelli neurali viene reimpostato ogni mese di calendario. Aprire una richiesta di supporto per aumentare il limite di training mensile. A partire dall'API v4.0, le richieste di addestramento oltre 20 richieste in un mese di calendario vengono fatturate secondo il livello di addestramento. Per informazioni dettagliate, vedere i prezzi .

4 Questo limite si applica a tutti i documenti presenti nella cartella del set di dati di training prima di eventuali aggiornamenti correlati all'etichettatura.

5 Questo limite si applica solo per v 4.0 (2024-11-30 GA) i modelli neurali personalizzati. A partire da v 4.0, supportiamo il training di documenti più grandi per durate più lunghe (fino a 10 ore gratuitamente e con addebiti successivi). Per altre informazioni, vedere la pagina del modello neurale personalizzato.

Descrizione dettagliata, rettifica delle quote e procedure consigliate

I limiti predefiniti possono essere estesi richiedendo un aumento tramite un ticket di supporto. Prima di richiedere un aumento della quota (se applicabile), assicurarsi che sia necessario.

Se l'applicazione restituisce il codice di risposta 429 (troppe richieste) si supera la soglia per una o più transazioni al secondo (TPS):

  • Analizzare il limite di transazioni al secondo TPS per l'invio di richieste di analisi (POST)
  • Limite di operazioni GET al secondo Il TPS per il polling dei risultati delle operazioni di analisi (GET)
  • Limite di operazioni di gestione dei modelli al secondo Operazioni correlate alla gestione dei modelli, ad esempio compilazione/training e copia.
  • Limite di operazioni di elenco per secondo Operazioni correlate all'elenco di modelli e operazioni.

Procedure consigliate generali per mitigare la limitazione

Per ridurre al minimo i problemi relativi alla limitazione (codice di risposta 429), è consigliabile usare le tecniche seguenti:

  • Implementare la logica di ripetizione dei tentativi nell'applicazione
  • Evitare modifiche nitide nel carico di lavoro. Aumentare gradualmente il carico di lavoro
    Esempio. L'applicazione usa Document Intelligence e il carico di lavoro corrente è 10 TPS (transazioni al secondo). Il secondo successivo si aumenta il carico a 40 TPS. Il risultato è un codice di risposta 429 per alcune richieste quando si supera il limite di 15 TPS per l'invio di operazioni di analisi. È possibile eseguire il back-off dell'elaborazione per rimanere sotto i 15 TPS o richiedere un aumento del TPS per supportare i volumi più elevati.

Le sezioni successive descrivono casi specifici di regolazione delle quote. Passare a Document Intelligence: aumento del limite di richieste simultanee

Aumento del limite di richieste di transazioni al secondo

Per impostazione predefinita, il numero di transazioni al secondo è limitato a 15 transazioni al secondo per una risorsa di Document Intelligence. Per il piano tariffario Standard, è possibile inviare richieste di aumento TPS, ma la possibilità di approvazione e a quale modifica del livello TPS dipenderanno dai modelli di utilizzo giornalieri e dalle procedure consigliate seguite. Prima di inviare la richiesta, assicurarsi di avere familiarità con il materiale in questa sezione e conoscere queste procedure consigliate.

L'aumento del limite di richieste simultanee non influisce direttamente sui costi. Il servizio Document Intelligence usa il modello "Pagamento solo per ciò che si usa". Il limite definisce il livello di scalabilità del servizio prima che inizi la limitazione delle richieste.

Il valore esistente di diverse categorie di limiti delle richieste è disponibile tramite Azure portale, nella scheda monitoraggio del pannello panoramica delle risorse.

Creare e inviare una richiesta di supporto per aumentare i TPS

Avviare l'aumento del limite di transazioni al secondo (TPS) per la risorsa inviando la richiesta di supporto:

  • Accedere al portale di Azure
  • Selezionare la risorsa di Intelligenza Documentale per la quale desideri aumentare il limite TPS
  • Selezionare -Nuova richiesta di supporto- (-gruppo Supporto + Risoluzione problemi-). Viene visualizzata una nuova finestra con informazioni popolate automaticamente sulla sottoscrizione Azure e sulla risorsa Azure
  • Immettere -Summary- (ad esempio, aumentare il limite TPS di Intelligence per i documenti)
  • Selezionare "Convalida quota o utilizzo" per il campo tipo di problema.
  • Selezionare -Avanti: Soluzioni-
  • Continuare con la creazione della richiesta
  • Immettere le informazioni seguenti nel campo -Description- nella scheda Dettagli:
    • Nota che la richiesta riguarda la quota di Document Intelligence.
    • Indicare il valore TPS che si vuole raggiungere attraverso la scalabilità. Anche se gli aumenti tps sono gratuiti, è consigliabile richiedere solo un TPS ragionevole per il carico di lavoro.
    • informazioni sulla risorsa Azure
    • Completare l'immissione delle informazioni necessarie e selezionare il pulsante -Crea- in -Review + crea- scheda
    • Prendere nota del numero di richiesta di supporto nelle notifiche del portale di Azure. Attendete che il Supporto vi contatti a breve per ulteriori procedure.

Esempio di procedura consigliata per il modello di carico di lavoro

Questo esempio presenta l'approccio consigliato per ridurre la possibile limitazione delle richieste. Non è una ricetta esatta, ma semplicemente un modello che invitiamo a seguire e regolare in base alle esigenze.

Si supponga che una risorsa di Document Intelligence abbia impostato il limite predefinito. Avvia il carico di lavoro per inviare le vostre richieste di analisi. Se notate di ricevere frequentemente una limitazione con il codice di risposta 429 quando verificate il completamento, iniziate implementando un backoff esponenziale sulla richiesta di analisi GET. Usando un tempo di attesa progressivamente più lungo tra i tentativi per le risposte di errore consecutive, ad esempio un modello 2-5-13-34 di ritardi tra le richieste. In generale, è consigliabile non chiamare la risposta get analyze più di una volta ogni 2 secondi per una richiesta POST corrispondente. La analyze risposta contiene anche un'intestazione retry-after che indica per quanto tempo è necessario attendere in secondi prima di verificare il completamento della richiesta.

Se si ritiene di essere limitato al numero di richieste POST per i documenti inviati, è consigliabile aggiungere un ritardo tra le richieste. Se il carico di lavoro richiede un livello superiore di elaborazione simultanea, è necessario creare una richiesta di supporto per aumentare i limiti di servizio per le transazioni al secondo.

In genere, è consigliabile testare il carico di lavoro e i modelli di carico di lavoro prima di passare all'ambiente di produzione.

Passaggi successivi