Content Analyzers - Create Or Replace
Créez un nouvel analyseur de façon asynchrone.
PUT {endpoint}/contentunderstanding/analyzers/{analyzerId}?api-version=2025-11-01
PUT {endpoint}/contentunderstanding/analyzers/{analyzerId}?api-version=2025-11-01&allowReplace={allowReplace}
Paramètres URI
| Nom | Dans | Obligatoire | Type | Description |
|---|---|---|---|---|
|
analyzer
|
path | True |
string minLength: 1maxLength: 64 pattern: ^[a-zA-Z0-9._-]{1,64}$ |
L’identifiant unique de l’analyseur. |
|
endpoint
|
path | True |
string (uri) |
Contenu : Compréhension du point de service de service. |
|
api-version
|
query | True |
string minLength: 1 |
Version de l’API à utiliser pour cette opération. |
|
allow
|
query |
boolean |
Permettre à l’opération de remplacer une ressource existante. |
En-tête de la demande
| Nom | Obligatoire | Type | Description |
|---|---|---|---|
| x-ms-client-request-id |
string (uuid) |
Identificateur de chaîne opaque, globalement unique et généré par le client pour la requête. |
Corps de la demande
| Nom | Type | Description |
|---|---|---|
| baseAnalyzerId |
string minLength: 1maxLength: 64 pattern: ^[a-zA-Z0-9._-]{1,64}$ |
L’analyseur pour entraîner progressivement. |
| config |
Paramètres de configuration de l’analyseur. |
|
| description |
string |
Une description de l’analyseur. |
| dynamicFieldSchema |
boolean |
Indique si le résultat peut contenir des champs supplémentaires en dehors du schéma défini. |
| fieldSchema |
Le schéma des champs à extraire. |
|
| knowledgeSources | KnowledgeSource[]: |
Des sources de connaissances supplémentaires servent à améliorer l’analyseur. |
| models |
object |
Mappage des rôles des modèles à des noms de modèles spécifiques. Exemple : { « complétion » : « gpt-4.1 », « embedding » : « text-embedding-3-large » }. |
| processingLocation |
L’endroit où les données peuvent être traitées. Par défaut, global. |
|
| tags |
object |
Des balises associées à l’analyseur. |
Réponses
| Nom | Type | Description |
|---|---|---|
| 200 OK |
La demande a réussi. En-têtes
|
|
| 201 Created |
La requête a réussi et une nouvelle ressource a été créée en conséquence. En-têtes
|
|
| Other Status Codes |
Réponse d’erreur inattendue. En-têtes x-ms-error-code: string |
Sécurité
Ocp-Apim-Subscription-Key
Authentification basée sur clé utilisant la clé d’accès de la ressource Azure.
Type:
apiKey
Dans:
header
EntraIdToken
Authentication OAuth2 par identifiant Microsoft Entra à l’aide d’un jeton d’accès.
Type:
oauth2
Flux:
accessCode
URL d’autorisation:
https://login.microsoftonline.com/common/oauth2/authorize
URL du jeton:
https://login.microsoftonline.com/common/oauth2/token
Étendues
| Nom | Description |
|---|---|
| https://cognitiveservices.azure.com/.default |
Exemples
Create or Replace Analyzer
Exemple de requête
PUT {endpoint}/contentunderstanding/analyzers/myAnalyzer?api-version=2025-11-01
{
"description": "My analyzer",
"tags": {
"createdBy": "John"
},
"baseAnalyzerId": "prebuilt-document",
"config": {
"enableFormula": false,
"returnDetails": true
},
"fieldSchema": {
"name": "MyForm",
"description": "My form",
"fields": {
"Company": {
"type": "string",
"description": "Name of company."
}
},
"definitions": {}
},
"knowledgeSources": [
{
"kind": "labeledData",
"containerUrl": "https://myStorageAccount.blob.core.windows.net/myContainer",
"prefix": "trainingData",
"fileListPath": "trainingData/fileList.jsonl"
}
]
}
Exemple de réponse
Operation-Location: https://myendpoint.cognitiveservices.azure.com/contentunderstanding/analyzers/myAnalyzer/operations/3b31320d-8bab-4f88-b19c-2322a7f11034?api-version=2025-11-01
{
"analyzerId": "myAnalyzer",
"description": "My analyzer",
"tags": {
"createdBy": "John"
},
"status": "creating",
"createdAt": "2025-05-01T18:46:36.051Z",
"lastModifiedAt": "2025-05-01T18:46:36.051Z",
"baseAnalyzerId": "prebuilt-document",
"config": {
"locales": null,
"enableOcr": true,
"enableLayout": true,
"enableFormula": false,
"returnDetails": true
},
"fieldSchema": {
"name": "MyForm",
"description": "My form",
"fields": {
"Company": {
"type": "string",
"description": "Name of company."
}
},
"definitions": {}
},
"knowledgeSources": [
{
"kind": "labeledData",
"containerUrl": "https://myStorageAccount.blob.core.windows.net/myContainer",
"prefix": "trainingData",
"fileListPath": "trainingData/fileList.jsonl"
}
]
}
Operation-Location: https://myendpoint.cognitiveservices.azure.com/contentunderstanding/analyzers/myAnalyzer/operations/3b31320d-8bab-4f88-b19c-2322a7f11034?api-version=2025-11-01
{
"analyzerId": "myAnalyzer",
"description": "My analyzer",
"tags": {
"createdBy": "John"
},
"status": "creating",
"createdAt": "2025-05-01T18:46:36.051Z",
"lastModifiedAt": "2025-05-01T18:46:36.051Z",
"baseAnalyzerId": "prebuilt-document",
"config": {
"locales": null,
"enableOcr": true,
"enableLayout": true,
"enableFormula": false,
"returnDetails": true
},
"fieldSchema": {
"name": "MyForm",
"description": "My form",
"fields": {
"Company": {
"type": "string",
"description": "Name of company."
}
},
"definitions": {}
},
"knowledgeSources": [
{
"kind": "labeledData",
"containerUrl": "https://myStorageAccount.blob.core.windows.net/myContainer",
"prefix": "trainingData",
"fileListPath": "trainingData/fileList.jsonl"
}
]
}
Définitions
| Nom | Description |
|---|---|
|
Annotation |
Format de représentation des annotations dans Analyze result markdown. |
|
Azure. |
Objet d’erreur. |
|
Azure. |
Une réponse contenant les détails de l’erreur. |
|
Azure. |
Objet contenant des informations plus spécifiques sur l’erreur. Conformément aux directives de l’API REST Azure : https://aka.ms/AzureRestApiGuidelines#handling-errors. |
|
Chart |
Format de représentation des graphiques dans l’analyse du marquage des résultats. |
|
Content |
Analyseur qui extrait le contenu et les champs de documents multimodaux. |
|
Content |
Paramètres de configuration pour un analyseur. |
|
Content |
Statut d’une ressource. |
|
Content |
Définition de la catégorie de contenu. |
|
Content |
Définition du champ utilisant une syntaxe de type schéma JSON. |
|
Content |
Schéma des champs à extraire des documents. |
|
Content |
Type de données sémantiques de la valeur du champ. |
|
Generation |
Méthode de génération. |
|
Knowledge |
Source de connaissances. |
|
Labeled |
Source de données de données intitulée. |
|
Processing |
L’endroit où les données peuvent être traitées. Par défaut, global. |
|
Supported |
Complétion de chat et modèles d’intégration pris en charge par l’analyseur. |
|
Table |
Format de représentation des tables dans Analyze result markdown. |
AnnotationFormat
Format de représentation des annotations dans Analyze result markdown.
| Valeur | Description |
|---|---|
| none |
Ne représentez pas des annotations. |
| markdown |
Représenter les informations de base sur les annotations en utilisant la mise en forme markdown. |
Azure.Core.Foundations.Error
Objet d’erreur.
| Nom | Type | Description |
|---|---|---|
| code |
string |
Un ensemble de codes d’erreur définis par le serveur. |
| details |
Tableau de détails sur des erreurs spécifiques qui ont conduit à cette erreur signalée. |
|
| innererror |
Objet contenant des informations plus spécifiques que l’objet actuel sur l’erreur. |
|
| message |
string |
Représentation lisible par l’homme de l’erreur. |
| target |
string |
Cible de l’erreur. |
Azure.Core.Foundations.ErrorResponse
Une réponse contenant les détails de l’erreur.
| Nom | Type | Description |
|---|---|---|
| error |
Objet d’erreur. |
Azure.Core.Foundations.InnerError
Objet contenant des informations plus spécifiques sur l’erreur. Conformément aux directives de l’API REST Azure : https://aka.ms/AzureRestApiGuidelines#handling-errors.
| Nom | Type | Description |
|---|---|---|
| code |
string |
Un ensemble de codes d’erreur définis par le serveur. |
| innererror |
Erreur intérieure. |
ChartFormat
Format de représentation des graphiques dans l’analyse du marquage des résultats.
| Valeur | Description |
|---|---|
| chartJs |
Représentez les graphiques comme Chart.js blocs de code. |
| markdown |
Représentez les graphiques comme des tableaux à déchiffrement. |
ContentAnalyzer
Analyseur qui extrait le contenu et les champs de documents multimodaux.
| Nom | Type | Valeur par défaut | Description |
|---|---|---|---|
| analyzerId |
string minLength: 1maxLength: 64 pattern: ^[a-zA-Z0-9._-]{1,64}$ |
L’identifiant unique de l’analyseur. |
|
| baseAnalyzerId |
string minLength: 1maxLength: 64 pattern: ^[a-zA-Z0-9._-]{1,64}$ |
L’analyseur pour entraîner progressivement. |
|
| config |
Paramètres de configuration de l’analyseur. |
||
| createdAt |
string (date-time) |
La date et l’heure de création de l’analyseur. |
|
| description |
string |
Une description de l’analyseur. |
|
| dynamicFieldSchema |
boolean |
False |
Indique si le résultat peut contenir des champs supplémentaires en dehors du schéma défini. |
| fieldSchema |
Le schéma des champs à extraire. |
||
| knowledgeSources | KnowledgeSource[]: |
Des sources de connaissances supplémentaires servent à améliorer l’analyseur. |
|
| lastModifiedAt |
string (date-time) |
La date et l’heure de la dernière modification de l’analyseur. |
|
| models |
object |
Mappage des rôles des modèles à des noms de modèles spécifiques. Exemple : { « complétion » : « gpt-4.1 », « embedding » : « text-embedding-3-large » }. |
|
| processingLocation | global |
L’endroit où les données peuvent être traitées. Par défaut, global. |
|
| status |
L’état de l’analyseur. |
||
| supportedModels |
Complétion de chat et modèles d’intégration pris en charge par l’analyseur. |
||
| tags |
object |
Des balises associées à l’analyseur. |
|
| warnings |
Avertissements rencontrés lors de la création de l’analyseur. |
ContentAnalyzerConfig
Paramètres de configuration pour un analyseur.
| Nom | Type | Valeur par défaut | Description |
|---|---|---|---|
| annotationFormat | markdown |
Format de représentation des annotations dans Analyze result markdown. |
|
| chartFormat | chartJs |
Format de représentation des graphiques dans l’analyse du marquage des résultats. |
|
| contentCategories |
<string,
Content |
Carte des catégories pour classer le(s) contenu(s) d’entrée. |
|
| disableFaceBlurring |
boolean |
Désactivez le flou par défaut des visages pour la confidentialité lors du traitement du contenu. |
|
| enableFigureAnalysis |
boolean |
Permettre l’analyse de figures, telles que des graphiques et des diagrammes. |
|
| enableFigureDescription |
boolean |
Permettre la génération de description de la figure. |
|
| enableFormula |
boolean |
Activez la détection mathématique des formules. |
|
| enableLayout |
boolean |
Activez l’analyse de la mise en page. |
|
| enableOcr |
boolean |
Activez la reconnaissance optique des caractères (OCR). |
|
| enableSegment |
boolean |
Activez la segmentation de l’entrée par contentCategories. |
|
| estimateFieldSourceAndConfidence |
boolean |
Retour sur le terrain et confiance au sol. |
|
| locales |
string[] |
Liste des indices locaux pour la transcription de la parole. |
|
| omitContent |
boolean |
Omettez le contenu de cet analyseur dans le résultat d’analyse. Ne retournez que le contenu provenant d’analyseurs supplémentaires spécifiés dans contentCategories, s’il y en a. |
|
| returnDetails |
boolean |
Retournez tous les détails du contenu. |
|
| segmentPerPage |
boolean |
Forcez la segmentation du contenu du document par page. |
|
| tableFormat | html |
Format de représentation des tables dans Analyze result markdown. |
ContentAnalyzerStatus
Statut d’une ressource.
| Valeur | Description |
|---|---|
| creating |
La ressource est en cours de création. |
| ready |
La ressource est prête. |
| deleting |
La ressource est en cours de suppression. |
| failed |
La ressource a échoué lors de la création. |
ContentCategoryDefinition
Définition de la catégorie de contenu.
| Nom | Type | Description |
|---|---|---|
| analyzer |
Définition optionnelle en ligne de l’analyseur utilisé pour traiter le contenu. |
|
| analyzerId |
string |
Analyseur optionnel utilisé pour traiter le contenu. |
| description |
string |
Description de la catégorie. |
ContentFieldDefinition
Définition du champ utilisant une syntaxe de type schéma JSON.
| Nom | Type | Description |
|---|---|---|
| $ref |
string |
Référence à une autre définition de champ. |
| description |
string |
Description du terrain. |
| enum |
string[] |
Énumération des valeurs possibles des champs. |
| enumDescriptions |
object |
Descriptions pour chaque valeur d’énumération. |
| estimateSourceAndConfidence |
boolean |
Retour à la source d’ancrage et confiance. |
| examples |
string[] |
Exemples de valeurs de champs. |
| items |
Schéma de type de champ de chaque élément du tableau, si le type est du tableau. |
|
| method |
Méthode de génération. |
|
| properties |
<string,
Content |
Sous-champs nommés, si le type est object. |
| type |
Type de données sémantiques de la valeur du champ. |
ContentFieldSchema
Schéma des champs à extraire des documents.
| Nom | Type | Description |
|---|---|---|
| definitions |
<string,
Content |
Définitions supplémentaires référencées par les champs du schéma. |
| description |
string |
Une description du schéma de champ. |
| fields |
<string,
Content |
Les champs définis dans le schéma. |
| name |
string |
Le nom du schéma de champs. |
ContentFieldType
Type de données sémantiques de la valeur du champ.
| Valeur | Description |
|---|---|
| string |
Texte brut. |
| date |
Date, normalisée au format ISO 8601 (YYY-MM-DD). |
| time |
Temps, normalisé au format ISO 8601 (hh :mm :ss). |
| number |
Numéro en virgule flottante de double précision. |
| integer |
Entier comme entier signé 64 bits. |
| boolean |
Valeur booléenne. |
| array |
Liste des sous-domaines du même type. |
| object |
Liste nommée des sous-champs. |
| json |
Objet JSON. |
GenerationMethod
Méthode de génération.
| Valeur | Description |
|---|---|
| generate |
Les valeurs sont générées librement en fonction du contenu. |
| extract |
Les valeurs sont extraites au fur et à mesure qu’elles apparaissent dans le contenu. |
| classify |
Les valeurs sont classées selon un ensemble prédéfini de catégories. |
KnowledgeSourceKind
Source de connaissances.
| Valeur | Description |
|---|---|
| labeledData |
Une source de données de connaissances marquée. |
LabeledDataKnowledgeSource
Source de données de données intitulée.
| Nom | Type | Description |
|---|---|---|
| containerUrl |
string (uri) |
L’URL du conteneur blob contenant les données étiquetées. |
| fileListPath |
string |
Un chemin optionnel vers un fichier listant des blobs spécifiques à inclure. |
| kind |
string:
labeled |
Le genre de source de connaissances. |
| prefix |
string |
Un préfixe optionnel pour filtrer les blobs dans le conteneur. |
ProcessingLocation
L’endroit où les données peuvent être traitées. Par défaut, global.
| Valeur | Description |
|---|---|
| geography |
Les données peuvent être traitées dans la même région que la ressource. |
| dataZone |
Les données peuvent être traitées dans la même zone de données que la ressource. |
| global |
Les données peuvent être traitées dans n’importe quel centre de données Azure à l’échelle mondiale. |
SupportedModels
Complétion de chat et modèles d’intégration pris en charge par l’analyseur.
| Nom | Type | Description |
|---|---|---|
| completion |
string[] |
Modèles de complétion de chat pris en charge par l’analyseur. |
| embedding |
string[] |
Intégration de modèles pris en charge par l’analyseur. |
TableFormat
Format de représentation des tables dans Analyze result markdown.
| Valeur | Description |
|---|---|
| html |
Représenter les tables à l’aide d’éléments HTML : <table>, <th>, <tr>, <td>. |
| markdown |
Représenter les tables en utilisant la syntaxe Flavored Markdown de GitHub, qui ne prend pas en charge les cellules fusionnées ni les en-têtes riches. |