Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
Content Understanding consente di implementare la classificazione e la suddivisione come parte della richiesta dell'operazione dell'analizzatore. È possibile eseguire la classificazione del contenuto e l'estrazione del contenuto come parte di una singola chiamata API.
Il concetto globale di analyzer include ora il concetto di contentCategories e enableSegment per classificare e suddividere i dati di input enableSegment che elabori all'interno dell'applicazione. Questa funzionalità dell'analizzatore può eseguire la classificazione di un file di input nel suo complesso. Può anche identificare più documenti o più istanze di un singolo documento all'interno di un file di input.
A partire dalla versione GA, la progettazione della classificazione dei documenti e la segmentazione video sono unificate, consentendo un approccio coerente per elaborare i dati di input indipendentemente dalla modalità. Nella documentazione, "Content Understanding classification" si riferisce alle operazioni di analisi necessarie per classificare e dividere i dati di input (contentCategories e enableSegment).
Casi d'uso aziendali
La classificazione di Comprensione contenuto consente di elaborare documenti e video complessi in diversi formati e modelli:
- Fatture: classificare le fatture da più fornitori per elaborare ogni categoria con un analizzatore Di comprensione del contenuto diverso, se necessario.
- Documenti fiscali: classificare più documenti fiscali in diversi tipi di moduli fiscali, ad esempio 1040 e 1099.
- Contratti: classificare contratti lunghi e non strutturati per semplificare le operazioni per comprendere diversi tipi di accordi e le relative implicazioni legali specifiche.
- Video sportivo: segmentare automaticamente le scene per suddividere il video in blocchi logici, ad esempio annunci e contenuti sportivi effettivi.
Funzionalità di classificazione/segmentazione
Content Understanding può analizzare documenti singoli o multi-file per identificare se un file di input può essere classificato in una categoria definita. Sono supportati gli scenari che seguono:
Scenari del documento:
- Classifica solo: classifica il file di input nel suo complesso. Ad esempio, un singolo file che contiene un tipo di documento, ad esempio un modulo di richiesta di prestito.
- Classificare e analizzare: classifica e analizza il file di input instradando l'input all'analizzatore di estrazione desiderato.
- Classificare e segmentare: classifica e segmenta un singolo file di input con più tipi o istanze di documenti concatenati. Ad esempio, un pacchetto di domanda di prestito che contiene un modulo di richiesta di prestito, una carta di pagamento e un estratto conto bancario. Un altro esempio è una raccolta di fatture scansionate in un singolo file.
- Classificare, segmentare e analizzare: una volta classificati i segmenti, instradare ogni segmento all'analizzatore di estrazione desiderato per un'ulteriore estrazione dei campi.
- Classificatore gerarchico: l'analisi aggiuntiva facoltativa a seconda della categoria può anche essere un analizzatore di classificatori.
Scenari video:
-
Solo segmento: suddividere il video in segmenti in base alle caratteristiche del contenuto definite nel
descriptioncampo dicontentCategories. Ad esempio, suddividere una trasmissione sportiva in segmenti di gioco, pubblicità e commenti. - Segmentare e analizzare: suddividere il video in segmenti e instradare ogni segmento a un analizzatore per l'estrazione dei campi.
Annotazioni
L'unità minima per la classificazione dei documenti è una singola pagina. La classificazione all'interno della pagina non è supportata.
Creare categorie di classificazione
La classificazione della comprensione del contenuto non richiede un set di dati di addestramento. È possibile definire fino a 200 nomi di categoria e descrizioni all'interno dell'operazione di analisi. Per impostazione predefinita, l'intero file viene considerato come un singolo oggetto contenuto, ovvero il file è associato a una singola categoria.
A partire dalla versione in disponibilità generale, è necessario includere la categoria other all'interno di contentCategories, per assicurarsi che il contenuto possa rimanere non corrispondente a una qualsiasi delle categorie definite. Se la other categoria non è inclusa, tutti i file vengono classificati in una delle categorie definite. Ogni nome di categoria definito all'interno contentCategories può includere anche un oggetto description per fornire altre informazioni sulla categoria che si sta definendo.
Suddivisione del file di input
Quando si dispone di più documenti in un file, il classificatore può identificare i diversi tipi di documento contenuti all'interno del file di input con funzionalità di suddivisione. La risposta del classificatore contiene gli intervalli di pagine per ognuno dei tipi di documento identificati contenuti all'interno di un file. Questa risposta può includere più istanze dello stesso tipo di documento.
Quando si esegue l'operazione analyze, include una proprietà enableSegment che ti consente di avere un controllo granulare sul comportamento di suddivisione. È anche possibile specificare i numeri di pagina per analizzare solo determinate pagine del documento di input:
- Per trattare l'intero file di input come più documenti combinati insieme per la classificazione, impostare
enableSegmentsutrue. In questo caso, il servizio restituisce automaticamente le categorie per i segmenti all'interno del file di input. - Per trattare l'intero file di input come un singolo documento, impostare
enableSegmentafalse.
Per impostazione predefinita, i segmenti iniziano in corrispondenza dei limiti della pagina. La versione dell'API 2026-06-01-preview aggiunge la segmentazione in pagina, che può suddividere una singola pagina in più segmenti quando contiene contenuto di tipi di documento diversi. La segmentazione in-page è controllata da un campo separato allowInPageSegments , pertanto è possibile acconsentire esplicitamente alle suddivisioni di pagine secondarie senza modificare il comportamento esistente enableSegment . Per altre informazioni, vedere Miglioramenti della classificazione (anteprima 2026-06-01).
Annotazioni
Per i video, è supportata solo la segmentazione. È necessario definire un singolo contentCategories con enableSegment impostato su true. Usare il description campo per specificare i criteri per suddividere il video in segmenti.
Analisi facoltativa
Per un flusso end-to-end completo, è possibile collegare categorie di classificatori con analizzatori personalizzati esistenti e analizzatori predefiniti. Per ogni oggetto contenuto classificato in categorie con analizzatori collegati, il servizio richiama automaticamente l'analisi sull'oggetto contenuto usando l'analizzatore corrispondente.
Ad esempio, è possibile usare questo collegamento per creare classificatori che identificano e analizzano solo le fatture da un PDF che contiene più tipi di moduli. Impostare analyzerId su un analizzatore predefinito o personalizzato per gestire e eseguire l'estrazione dei campi dai documenti o dalle pagine classificate.
È anche possibile omettere l'impostazione di qualsiasi analyzerId elemento da classificare, ma non eseguire alcuna analisi del contenuto nel file o nel segmento categorizzato.
Al livello superiore, è anche possibile impostare omitContent su true per omettere l'oggetto del contenuto originale e restituire solo gli oggetti di contenuto dall'analisi eseguita sui segmenti o sui file classificati.
Classificatore gerarchico
L'operazione dell'analizzatore supporta la suddivisione gerarchica e la classificazione. Nell'operazione dell'analizzatore di base impostare analyzerId su ogni categoria di contenuto un analizzatore personalizzato che esegue una classificazione o una suddivisione aggiuntive. Questo approccio supporta scenari quali fatture, contratti e ricevute, in cui ogni categoria può puntare a un'altra operazione dell'analizzatore analyzerId che classifica diversi sottotipi di documento.
Gli input del documento supportano cinque livelli di annidamento e gli input video supportano due.
Miglioramenti alla classificazione (anteprima 2026-06-01)
Le sezioni precedenti descrivono il comportamento ga. Questa sezione descrive le funzionalità di sola anteprima che richiedono la versione 2026-06-01-previewAPI .
La versione dell'API 2026-06-01-preview include due miglioramenti per la classificazione e la suddivisione dei documenti. Per usare questi miglioramenti, impostare come destinazione la versione dell'API di anteprima quando si invia una richiesta di analisi.
Importante
Queste funzionalità sono disponibili in anteprima pubblica. Le funzionalità di anteprima vengono fornite senza un contratto di servizio e non sono consigliate per i carichi di lavoro di produzione.
Estrazione delle funzionalità basata su layout (anteprima)
Nell'API 2026-06-01-preview il classificatore aggiunge segnali di classificazione avanzati, ad esempio funzionalità del documento basate sul layout, marcatori di sezione, intestazioni di tabella, descrizioni delle figure e altro ancora.
Il campionamento con riconoscimento del layout migliora l'accuratezza della classificazione negli scenari in cui il contenuto distintivo è altamente non strutturato o distribuito in una pagina. Ad esempio:
- Pagine sparse nel testo, ad esempio immagini a raggi X o report di diagnostica analizzati.
- Pagine con un numero elevato di figure, in cui una descrizione della figura contiene la maggior parte del segnale di classificazione.
- Pagine in cui le intestazioni di sezione chiave o le intestazioni di tabella vengono visualizzate al centro della pagina.
Non è necessaria alcuna modifica alla configurazione. Quando si chiama l'API di anteprima, il classificatore usa automaticamente le funzionalità basate sul layout.
Segmentazione in-page (anteprima)
L'API 2026-06-01-preview aggiunge la segmentazione in pagina , che può suddividere una singola pagina in più segmenti quando la pagina contiene contenuto appartenente a tipi di documento diversi.
La segmentazione in-page è utile per scenari come:
- I registri medici in cui una singola pagina combina tipi di contenuto, ad esempio una sezione dei dati demografici dei pazienti seguita da un ordine di riferimento nella stessa pagina.
- Pacchetti fiscali in cui più pianificazioni o moduli sono impilati nella stessa pagina, ad esempio le pianificazioni K-1.
- Pacchetti in più moduli in cui i moduli consecutivi non iniziano sempre in una nuova pagina.
Per abilitare la segmentazione nella pagina, impostare su allowInPageSegmentstrue quando si crea o si aggiorna un analizzatore personalizzato (non è possibile impostare questo campo in una richiesta di analisi). La risposta dell'analizzatore include intervalli di pagine per segmento, categoria di ogni segmento, punteggio di attendibilità e un'espressione di origine che identifica la posizione di delimitazione del segmento nella pagina.
L'esempio seguente mostra la segments matrice in una risposta di analisi, in cui una singola pagina è suddivisa in un segmento di carta di credito e in un segmento di carta di identità:
"segments": [
{
"span": {
"offset": 0,
"length": 301
},
"segmentId": "segment1",
"startPageNumber": 1,
"endPageNumber": 1,
"category": "Credit_card",
"confidence": 0.98,
"source": "D(1,1.32,1.49,3.13,1.49,3.13,3.86,1.32,3.86)"
},
{
"span": {
"offset": 301,
"length": 798
},
"segmentId": "segment2",
"startPageNumber": 1,
"endPageNumber": 1,
"category": "Identity_card",
"confidence": 0.99,
"source": "D(1,1.16,4.95,3.82,4.95,3.82,8.52,1.16,8.52)"
}
]
Campi API
I campi API seguenti supportano la segmentazione nella pagina:
| Campo | Tipo | Description |
|---|---|---|
ContentAnalyzerConfig.allowInPageSegments |
boolean |
Impostare quando si crea o si aggiorna un analizzatore personalizzato. Quando true, i segmenti possono coprire una parte di una pagina anziché pagine complete. |
DocumentContentSegment.segmentId |
string |
Identificatore stabile per il segmento, ad esempio segment1. |
DocumentContentSegment.span |
Span |
offset e length del segmento all'interno del testo del contenuto padre in formato Markdown. |
DocumentContentSegment.confidence |
float32 |
Valore in [0–1]. Punteggio di attendibilità per la segmentazione e la classificazione delle categorie. |
DocumentContentSegment.source |
SourceExpression |
Posizione di delimitazione del segmento nella pagina, come espressione poligono del formato D(pageNumber, x1, y1, x2, y2, x3, y3, x4, y4). Passare questo valore come oggetto range a un analizzatore secondario. |
Limiti del classificatore
Per informazioni sui formati di documento di input supportati e sui limiti del classificatore, vedere Quote e limiti del servizio.
Procedure consigliate
Per migliorare la qualità di classificazione e suddivisione, usare un nome di categoria e una descrizione validi in modo che il modello possa comprendere le categorie con un contesto specifico. Per altre informazioni sui nomi e le descrizioni delle categorie, vedere Procedure consigliate.
Vantaggi principali
- Accuratezza e affidabilità: garantire una classificazione precisa dei documenti per ridurre gli errori e aumentare l'efficienza.
- Scalabilità: scalare l'elaborazione dei documenti per soddisfare le esigenze aziendali.
- Personalizzabile: adattare il classificatore di documenti in base a flussi di lavoro specifici.
Lingue e aree supportate
Per un elenco delle lingue e delle aree supportate, vedere Supporto di lingue e aree geografiche.
Privacy e sicurezza dei dati
Se utilizzi Content Understanding, esamina i criteri Microsoft sui dati dei clienti. Per altre informazioni, vedere Dati, protezione e privacy.
Contenuti correlati
- Provare a elaborare il contenuto del documento in Content Understanding Studio
- Informazioni su come elaborare il contenuto del documento usando i modelli di analizzatore.