Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Ce contenu s’applique à :🟩v4.0 (GA) | Versions précédentes :🟦v3.1 (GA)🟥v3.0 (mise hors service)
Ce contenu s’applique à :🟥v2.1 | Dernière version :🟪v4.0 (GA)
Cet article contient à la fois une référence rapide et une description détaillée de Azure Document Intelligence dans les quotas et limites des outils Foundry pour tous les niveaux de tarification . Il présente également les meilleures pratiques pour éviter la limitation des demandes.
Utilisation du modèle
| Types de documents pris en charge | Lire | Mise en page | Modèles prédéfinis | Modèles personnalisés | Fonctionnalités de module complémentaire |
|---|---|---|---|---|---|
| ✔️ | ✔️ | ✔️ | ✔️ | ✔️ | |
Images : JPEG/JPG, , PNGBMP, TIFF,HEIF |
✔️ | ✔️ | ✔️ | ✔️ | ✔️ |
Microsoft Office : DOCX, PPTX, XLS |
✔️ | ✔️ | ✖️ | ✖️ | ✖️ |
✔️ = pris en charge ✖️ = Non pris en charge
Pour Document Intelligence v4.0 2024-11-30 (GA) prend en charge les fonctionnalités de page et de ligne avec les restrictions suivantes :
- L’angle, la largeur/la hauteur et l’unité de mesure ne sont pas supportés.
- Pour chaque objet détecté, le polygone englobant ou les régions englobantes ne sont pas pris en charge.
- L’objet
linesn’est pas pris en charge.
| Types de documents pris en charge | Lire | Mise en page | Modèles prédéfinis | Modèles personnalisés |
|---|---|---|---|---|
| ✔️ | ✔️ | ✔️ | ✔️ | |
Images : JPEG/JPG, , PNGBMP, TIFF,HEIF |
✔️ | ✔️ | ✔️ | ✔️ |
Microsoft Office : DOCX, PPTX, XLS |
✔️ | ✖️ | ✖️ | ✖️ |
✔️ = pris en charge ✖️ = Non pris en charge
Facturation
La facturation Document Intelligence est calculée mensuellement en fonction du type de modèle et du nombre de pages analysées. Vous trouverez des métriques d’utilisation sur le tableau de bord des métriques dans le portail Azure. Le tableau de bord affiche le nombre de pages que Document Intelligence d'Azure traite. Vous pouvez vérifier le coût estimé dépensé sur la ressource à l’aide de la calculatrice de prix Azure. Pour obtenir des instructions détaillées, consultez Vérifier l’utilisation et estimer le coût. Voici quelques détails :
Lorsque vous envoyez un document à des fins d’analyse, le service analyse toutes les pages, sauf si vous spécifiez une plage de pages à l’aide du
pagesparamètre dans votre demande. Lorsque le service analyse les documents Microsoft Excel et PowerPoint par le biais du modèle de lecture, de l'OCR ou de mise en page, il compte chaque feuille de calcul Excel et chaque diapositive PowerPoint comme une page.Lorsque le service analyse les fichiers PDF et TIFF, il compte chaque page dans le fichier PDF ou chaque image du fichier TIFF en tant que page sans limites de caractères maximales.
Lorsque le service analyse Microsoft Word et les fichiers HTML pris en charge par les modèles de lecture et de disposition, il compte les pages en blocs de 3 000 caractères chacun. Par exemple, si votre document contient 7 000 caractères, les deux pages avec 3 000 caractères chacun et une page avec 1 000 caractères s’ajoutent à un total de trois pages.
Les modèles de lecture et de disposition ne prennent pas en charge l'analyse des images incorporées ou liées dans des fichiers MICROSOFT WORD, Excel, PowerPoint et HTML. Par conséquent, le service ne les compte pas comme images ajoutées.
L’entraînement d’un modèle personnalisé est toujours gratuit avec Document Intelligence. Les frais sont facturés uniquement lorsque le service utilise un modèle pour analyser un document.
La tarification des conteneurs est la même que la tarification du service cloud.
Document Intelligence offre un niveau gratuit (F0) où vous pouvez tester toutes les fonctionnalités Document Intelligence. Le niveau gratuit limite l’analyse de la réponse aux deux premières pages d’une requête.
Document Intelligence a un modèle tarifaire basé sur l’engagement pour les charges de travail volumineuses.
Le modèle de disposition est requis pour générer des étiquettes pour votre jeu de données pour l’entraînement personnalisé. Si le jeu de données que vous utilisez pour l’apprentissage personnalisé n’a pas de fichiers d’étiquette disponibles, le service les génère pour vous et vous facture l’utilisation du modèle de disposition.
| Quota | Gratuit (F0)1 | Standard (S0) |
|---|---|---|
| Analyser la limite des transactions par seconde | 1 | 15 (valeur par défaut) |
| Réglable | Non | Oui 2 |
| Consulter la limite des opérations par seconde | 1 | 50 (valeur par défaut) |
| Réglable | Non | Oui 2 |
| Limite des opérations de gestion des modèles par seconde | 1 | 5 (valeur par défaut) |
| Réglable | Non | Oui 2 |
| Limite des opérations de liste par seconde | 1 | 10 (valeur par défaut) |
| Réglable | Non | Oui 2 |
| Taille maximale du document | 4 Mo | 500 Mo |
| Réglable | Non | Non |
| Nombre maximal de pages (Analyse) | 2 | 2000 |
| Réglable | Non | Non |
| Taille maximale du fichier d’étiquettes | 10 Mo | 10 Mo |
| Réglable | Non | Non |
| Taille maximale de la réponse JSON OCR | 500 Mo | 500 Mo |
| Réglable | Non | Non |
| Nombre maximal de modèles de gabarit | 500 | 5000 |
| Réglable | Non | Non |
| Nombre maximal de modèles neuronaux | 100 | 500 |
| Réglable | Non | Non |
Utilisation personnalisée du modèle
| Quota | Gratuit (F0) 1 | Standard (S0) |
|---|---|---|
| Limite de composition du modèle | 5 | 500 (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’apprentissage * Neuronal et Génératif | 1 Go 3 | 1 Go (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Modèle | 50 Mo 4 | 50 Mo (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de pages (entraînement) * modèle | 500 | 500 (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de pages (entraînement) * Neuronal et Génératif | 50,000 | 50 000 (valeur par défaut) |
| Réglable | Non | Non |
| Apprentissage de modèle neuronal personnalisé | 10 heures par mois 5 | aucune limite (paiement par heure), commencez par 10 heures gratuites chaque mois |
| Réglable | Non | Oui 3 |
| Nombre maximal de pages (formation) * Classifieur | 25,000 | 25 000 (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de types de documents (classes) * Classifieur | 1000 | 1000 (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Classifieur | 1GO | 2 Go (valeur par défaut) |
| Réglable | Non | Non |
| Nombre minimal d’échantillons par classe * Classifieur | 5 | 5 (valeur par défaut) |
| Réglable | Non | Non |
Utilisation personnalisée du modèle
| Quota | Gratuit (F0) 1 | Standard (S0) |
|---|---|---|
| Limite de composition du modèle | 5 | 200 (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Neural | 1 Go 3 | 1 Go (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Modèle | 50 Mo 4 | 50 Mo (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de pages (entraînement) * modèle | 500 | 500 (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximum de pages (Entraînement) * Neural | 50,000 | 50 000 (valeur par défaut) |
| Réglable | Non | Non |
| Apprentissage de modèle neuronal personnalisé | 10 par mois | 20 par mois |
| Réglable | Non | Oui 3 |
| Nombre maximal de pages (formation) * Classifieur | 10 000 | 10 000 (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de types de documents (classes) * Classifieur | 500 | 500 (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Classifieur | 1GO | 1 Go (valeur par défaut) |
| Réglable | Non | Non |
| Nombre minimal d’échantillons par classe * Classifieur | 5 | 5 (valeur par défaut) |
| Réglable | Non | Non |
Utilisation personnalisée du modèle
| Quota | Gratuit (F0) 1 | Standard (S0) |
|---|---|---|
| Limite de composition du modèle | 5 | 200 (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Neural | 1 Go 3 | 1 Go (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Modèle | 50 Mo 4 | 50 Mo (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de pages (entraînement) * modèle | 500 | 500 (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximum de pages (Entraînement) * Neural | 50,000 | 50 000 (valeur par défaut) |
| Réglable | Non | Non |
| Apprentissage de modèle neuronal personnalisé | 10 par mois | 20 par mois |
| Réglable | Non | Oui 3 |
| Nombre maximal de pages (formation) * Classifieur | 10 000 | 10 000 (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de types de documents (classes) * Classifieur | 500 | 500 (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement * Classifieur | 1GO | 1 Go (valeur par défaut) |
| Réglable | Non | Non |
| Nombre minimal d’échantillons par classe * Classifieur | 5 | 5 (valeur par défaut) |
| Réglable | Non | Non |
Limites de modèle personnalisées
| Quota | Gratuit (F0) 1 | Standard (S0) |
|---|---|---|
| Limite de composition du modèle | 5 | 200 (valeur par défaut) |
| Réglable | Non | Non |
| Taille du jeu de données d’entraînement | 50 Mo | 50 Mo (valeur par défaut) |
| Réglable | Non | Non |
| Nombre maximal de pages (formation) | 500 | 500 (valeur par défaut) |
| Réglable | Non | Non |
1 Pour le niveau tarifaire gratuit (F0), consultez également les allocations mensuelles sur la page de tarification.
2 Consultez les meilleures pratiques et les instructions d’ajustement.
3 Nombre d’entraînement de modèles neuronaux est réinitialisé chaque mois calendrier. Ouvrez une demande de support pour augmenter la limite de formation mensuelle. À compter de l’API v4.0, les demandes d’entraînement supérieures à 20 requêtes dans un mois calendrier sont facturées sur le niveau d’entraînement. Pour plus d’informations, consultez la tarification .
4 Cette limite s’applique à tous les documents trouvés dans votre dossier de jeu de données d’entraînement avant les mises à jour liées à l’étiquetage.
5 Cette limite s’applique uniquement aux
v 4.0 (2024-11-30 GA)modèles neuronaux personnalisés. À partir dev 4.0, nous prenons en charge le traitement de documents plus volumineux pendant de plus longues durées (jusqu’à 10 heures gratuitement, avec des frais supplémentaires ensuite). Pour plus d’informations, reportez-vous à la page de modèle neuronal personnalisé.
Description détaillée, ajustement du quota et bonnes pratiques
Les limites par défaut peuvent être étendues en demandant une augmentation via un ticket de support. Avant de demander une augmentation de quota (le cas échéant), assurez-vous qu’elle est nécessaire.
Si votre application retourne le code de réponse 429 (Trop de demandes) vous dépassez le seuil d’une ou plusieurs transactions par seconde limites (TPS) :
- Analyser la limite de transactions par seconde Le TPS pour l’envoi de requêtes d’analyse (POST)
- Obtenir la limite d’opérations par seconde Le TPS pour l’interrogation des résultats des opérations d’analyse (GET)
- Opérations de gestion des modèles par seconde limite Opérations liées à la gestion des modèles, telles que la génération/l’apprentissage et la copie.
- Limiter le nombre d'opérations de liste par seconde Opérations liées à l'énumération des modèles et des opérations.
Meilleures pratiques pour atténuer la limitation de requêtes
Pour réduire les problèmes liés à la limitation (code de réponse 429), nous vous recommandons d’utiliser les techniques suivantes :
- Implémenter une logique de nouvelle tentative dans votre application
- Évitez les modifications nettes dans la charge de travail. Augmenter progressivement la charge de travail
Exemple. Votre application utilise Document Intelligence et votre charge de travail actuelle est de 10 TPS (transactions par seconde). La seconde suivante, vous augmentez la charge à 40 TPS. Le résultat est un code de réponse 429 pour certaines demandes, car la limite de 15 TPS pour soumettre des opérations d'analyse est dépassée. Vous pouvez soit ralentir le traitement pour rester en dessous des 15 TPS, soit demander une augmentation du TPS pour prendre en charge vos volumes plus élevés.
Les sections suivantes décrivent des cas spécifiques d’ajustement des quotas. Accéder à Document Intelligence : augmentation de la limite de requêtes simultanées
Augmentation de la mimite de demandes de transactions par seconde
Par défaut, le nombre de transactions par seconde est limité à 15 transactions par seconde pour une ressource Document Intelligence. Pour le niveau tarifaire Standard, les demandes d’augmentation tpS peuvent être soumises, mais si elles peuvent être approuvées et à quel niveau de tpS l’ajustement dépend des modèles d’utilisation quotidiens et des meilleures pratiques qui sont suivies. Avant de soumettre la demande, assurez-vous que vous êtes familiarisé avec le matériel de cette section et que vous connaissez ces meilleures pratiques.
L’augmentation de la limite de demandes simultanées n’affecte pas directement vos coûts. Le service Document Intelligence utilise le modèle « Payer uniquement pour ce que vous utilisez ». La limite définit jusqu'où le service peut se développer avant qu'il ne commence à restreindre vos requêtes.
La valeur existante de différentes catégories de limites de requête est disponible via Azure portail, sous l’onglet Surveillance du panneau Vue d’ensemble des ressources.
Créer et envoyer une demande d’assistance pour l’augmentation du TPS
Lancez l’augmentation des transactions par seconde (TPS) limite pour votre ressource en envoyant la demande de support :
- Connectez-vous au portail Azure
- Sélectionnez la ressource Document Intelligence pour laquelle vous souhaitez augmenter la limite TPS
- Sélectionnez -Nouvelle demande de support- (-Support + résolution des problèmes- groupe). Une nouvelle fenêtre s’affiche avec des informations renseignées automatiquement sur votre abonnement Azure et Azure ressource
- Entrez -Summary- (par exemple, « Augmenter la limite de TPS de Document Intelligence »)
- Sélectionnez « Validation du quota ou de l’utilisation » pour le champ de type de problème.
- Sélectionner -Suivant : Solutions
- Poursuivre la création de la demande
- Entrez les informations suivantes dans le champ -Description, sous l’onglet Détails :
- Veuillez noter que la demande concerne le quota Document Intelligence.
- Fournir une prévision TPS pour laquelle vous souhaitez effectuer une mise à l’échelle. Bien que les augmentations de TPS soient gratuites, vous devez uniquement demander un niveau de TPS adapté à votre charge de travail.
- informations sur les ressources Azure
- Complétez la saisie des informations requises et sélectionnez le bouton -Créer- dans l'onglet -Réviser + créer-.
- Notez le numéro de demande de support dans les notifications du portail Azure. Attendez que le support technique vous contacte prochainement pour un suivi ultérieur.
Exemple de bonne pratique de modèle de charge de travail
Cet exemple présente l’approche que nous vous recommandons de suivre pour atténuer le possible étranglement des demandes. Ce n’est pas une recette exacte, mais simplement un modèle que nous invitons à suivre et à ajuster si nécessaire.
Supposons qu’une ressource Document Intelligence a la limite par défaut définie. Lancez la charge de travail pour soumettre vos requêtes d'analyse. Si vous observez des limitations fréquentes avec le code de réponse 429 lors de la vérification de l’achèvement, commencez par implémenter un mécanisme de recul exponentiel sur la requête GET de réponse d’analyse. En utilisant un temps d’attente progressivement plus long entre les nouvelles tentatives pour les réponses d’erreur consécutives, par exemple un modèle 2-5-13-34 de retards entre les requêtes. En général, nous vous recommandons de ne pas appeler la réponse d'analyse "get" plus d'une fois toutes les 2 secondes pour une requête POST correspondante. La analyze réponse contient également un en-tête retry-after qui indique la durée en secondes pendant laquelle vous devez attendre avant de vérifier l’achèvement de cette demande.
Si vous constatez que vous êtes limité au nombre de demandes POST pour les documents envoyés, envisagez d’ajouter un délai entre les demandes. Si votre charge de travail nécessite un plus grand degré de traitement simultané, vous devez ensuite créer une demande de support pour augmenter vos limites de service sur les transactions par seconde.
En règle générale, nous vous recommandons de tester la charge de travail et les modèles de charge de travail avant de passer en production.