Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
O Content Understanding permite implementar a classificação e a divisão como parte da solicitação de operação do analisador. Você pode executar a classificação de conteúdo e a extração de conteúdo como parte de uma única chamada à API.
O conceito global de analyzer agora inclui os conceitos de contentCategories e enableSegment para classificar e dividir os dados de entrada que você processa em seu aplicativo. Esse recurso do analisador pode executar a classificação de um arquivo de entrada como um todo. Ele também pode identificar vários documentos ou várias instâncias de um único documento em um arquivo de entrada.
A partir da versão ga, a classificação de documentos e o design de segmentação de vídeo são unificados, permitindo uma abordagem coerente para processar dados de entrada, independentemente de sua modalidade. Na documentação, "Classificação da Compreensão de conteúdo" refere-se às operações de análise necessárias para classificar e dividir dados de entrada (contentCategories e enableSegment).
Casos de uso de negócios
A classificação de Compreensão de Conteúdo permite processar documentos e vídeos complexos em vários formatos e modelos:
- Faturas: categorize faturas de vários fornecedores para processar cada categoria com um analisador de Compreensão de Conteúdo diferente, se necessário.
- Documentos fiscais: Categorize vários documentos fiscais em diferentes tipos de formulários fiscais, como 1040 e 1099.
- Contratos: categorize contratos longos e não estruturados para simplificar as operações para entender diferentes tipos de contratos e suas implicações legais específicas.
- Vídeo esportivo: Segmente automaticamente as cenas para dividir o vídeo em partes lógicas, como anúncios e o conteúdo esportivo real.
Recursos de classificação/segmentação
O Content Understanding pode analisar documentos individuais ou de vários arquivos para identificar se um arquivo de entrada pode ser classificado em uma categoria definida. Os cenários a seguir têm suporte:
Cenários de documento:
- Classificar somente: classifica o arquivo de entrada como um todo. Por exemplo, um único arquivo que contém um tipo de documento, como um formulário de solicitação de empréstimo.
- Classificar e analisar: classifica e analisa o arquivo de entrada roteando a entrada para o analisador de extração desejado.
- Classificar e segmentar: classifica e segmenta um único arquivo de entrada que pode ter vários tipos ou instâncias de documentos concatenados. Por exemplo, um pacote de pedido de empréstimo que contém um formulário de solicitação de empréstimo, boleto de pagamento e extrato bancário. Outro exemplo é uma coleção de faturas digitalizadas em um único arquivo.
- Classificar, segmentar e analisar: depois que os segmentos forem classificados, encaminhe cada segmento para o analisador de extração desejado para extração de campo adicional.
- Classificador hierárquico: uma análise adicional e opcional, que dependa da categoria, também pode funcionar como um analisador de classificador.
Cenários de vídeo:
-
Somente segmento: dividir vídeo em segmentos com base nas características de conteúdo definidas no
descriptioncampo decontentCategories. Por exemplo, dividir uma transmissão esportiva em segmentos de jogos, comerciais e comentários. - Segmentar e analisar: divida o vídeo em segmentos e encaminhe cada segmento para um analisador para extração de campo.
Observação
A unidade mínima para classificação de documentos é uma única página. Não há suporte para a classificação intra-página.
Criar categorias de classificação
A classificação de Reconhecimento de Conteúdo não requer um conjunto de dados de treinamento. Você pode definir até 200 nomes de categoria e descrições dentro da operação de análise. Por padrão, todo o arquivo é tratado como um único objeto de conteúdo, o que significa que o arquivo está associado a uma única categoria.
A partir da versão GA, você precisa incluir a categoria other dentro de contentCategories para garantir que o conteúdo possa permanecer não associado a nenhuma das suas categorias definidas. Se a other categoria não estiver incluída, todos os arquivos serão classificados em uma de suas categorias definidas. Cada um dos nomes de categoria que você define contentCategories também pode incluir um description para fornecer mais informações sobre a categoria que você está definindo.
Divisão de arquivo de entrada
Quando você tem mais de um documento em um arquivo, o classificador pode identificar os diferentes tipos de documento contidos no arquivo de entrada com a capacidade de divisão. A resposta do classificador contém os intervalos de página para cada um dos tipos de documento identificados contidos em um arquivo. Essa resposta pode incluir várias instâncias do mesmo tipo de documento.
Quando você executa a analyze operação, ela inclui uma enableSegment propriedade que fornece controle granular sobre o comportamento de divisão. Você também pode especificar os números de página para analisar apenas determinadas páginas do documento de entrada:
- Para tratar todo o arquivo de entrada como vários documentos combinados para classificação, defina
enableSegmentcomotrue. Quando você faz isso, o serviço retorna categorias para os segmentos dentro do arquivo de entrada automaticamente. - Para tratar todo o arquivo de entrada como um único documento, defina
enableSegmentcomofalse.
Por padrão, os segmentos começam nos limites da página. A 2026-06-01-preview versão da API adiciona a segmentação na página, que pode dividir uma única página em vários segmentos quando contém conteúdo de diferentes tipos de documento. A segmentação na página é controlada por um campo separado allowInPageSegments , para que você possa aceitar divisões de subpasta sem alterar o comportamento existente enableSegment . Para obter mais informações, consulte Aprimoramentos de classificação (versão prévia 2026-06-01).
Observação
Para vídeos, há suporte apenas para segmentação. Você deve definir um único contentCategories com enableSegment definido como true. Use o description campo para especificar critérios para dividir o vídeo em segmentos.
Análise opcional
Para um fluxo completo de ponta a ponta, você pode vincular categorias de classificador com analisadores personalizados existentes e analisadores predefinidos. Para cada objeto de conteúdo classificado para categorias com analisadores vinculados, o serviço invoca automaticamente a análise no objeto de conteúdo usando o analisador correspondente.
Por exemplo, você pode usar essa vinculação para criar classificadores que identificam e analisam apenas faturas de um PDF que contém vários tipos de formulários. Defina analyzerId como um analisador predefinido ou analisador personalizado para rotear e executar a extração de campo dos documentos ou páginas classificados.
Você também pode omitir a configuração de qualquer analyzerId para categorizar, mas sem executar nenhuma análise de conteúdo no arquivo ou segmento categorizado.
Na camada superior, você também pode definir omitContent para true omitir o objeto de conteúdo original e retornar somente objetos de conteúdo da análise executada nos segmentos ou arquivos classificados.
Classificador hierárquico
A operação do analisador dá suporte à divisão e classificação hierárquicas. Na operação do analisador base, defina analyzerId em cada categoria de conteúdo como um analisador personalizado que executa classificação ou divisão adicionais. Essa abordagem dá suporte a cenários como faturas, contratos e recibos, em que cada categoria analyzerId pode apontar para outra operação de analisador que classifica diferentes subtipos de documento.
As entradas de documento dão suporte a cinco níveis de aninhamento e as entradas de vídeo dão suporte a dois.
Aprimoramentos de classificação (versão prévia 2026-06-01)
As seções anteriores descrevem o comportamento de GA. Esta seção descreve os recursos somente visualização que exigem a versão 2026-06-01-previewda API.
A 2026-06-01-preview versão da API inclui dois aprimoramentos na classificação e divisão de documentos. Para usar esses aprimoramentos, direcione a versão da API de visualização ao enviar uma solicitação de análise.
Importante
Esses recursos estão em versão prévia pública. Os recursos de visualização são fornecidos sem um contrato de nível de serviço e não são recomendados para cargas de trabalho de produção.
Extração de recursos baseada em layout (versão prévia)
2026-06-01-preview Na API, o classificador adiciona sinais de classificação avançados, como recursos de documento baseados em layout - marcadores de seção, cabeçalhos de tabela, descrições de figura e muito mais.
A amostragem com reconhecimento de layout melhora a precisão de classificação em cenários em que o conteúdo diferenciante é altamente não estruturado ou distribuído em uma página. Por exemplo:
- Páginas esparsas em texto, por exemplo, imagens de raio-X ou relatórios de diagnóstico verificados.
- Páginas pesadas, em que uma descrição de figura carrega a maior parte do sinal de classificação.
- Páginas em que cabeçalhos de seção de chave ou cabeçalhos de tabela aparecem no meio da página.
Nenhuma alteração de configuração é necessária. Quando você chama a API de visualização, o classificador usa automaticamente os recursos baseados em layout.
Segmentação na página (versão prévia)
A 2026-06-01-preview API adiciona a segmentação na página , que pode dividir uma única página em vários segmentos quando a página contém conteúdo que pertence a diferentes tipos de documento.
A segmentação na página é útil para cenários como:
- Registros médicos em que uma única página mistura tipos de conteúdo, por exemplo, uma seção demográfica do paciente seguida por uma ordem de encaminhamento na mesma página.
- Pacotes de impostos em que vários agendamentos ou formulários são empilhados na mesma página, por exemplo, agendamentos K-1.
- Pacotes de vários formulários em que formulários consecutivos nem sempre começam em uma nova página.
Para habilitar a segmentação na página, defina allowInPageSegments para true quando você criar ou atualizar um analisador personalizado (não é possível definir esse campo em uma solicitação de análise). A resposta do analisador inclui intervalos de páginas por segmento, categoria de cada segmento, uma pontuação de confiança e uma expressão de origem que identifica a posição delimitador do segmento na página.
O exemplo a seguir mostra a segments matriz em uma resposta de análise, em que uma única página é dividida em um segmento de cartão de crédito e um segmento de cartão de identidade:
"segments": [
{
"span": {
"offset": 0,
"length": 301
},
"segmentId": "segment1",
"startPageNumber": 1,
"endPageNumber": 1,
"category": "Credit_card",
"confidence": 0.98,
"source": "D(1,1.32,1.49,3.13,1.49,3.13,3.86,1.32,3.86)"
},
{
"span": {
"offset": 301,
"length": 798
},
"segmentId": "segment2",
"startPageNumber": 1,
"endPageNumber": 1,
"category": "Identity_card",
"confidence": 0.99,
"source": "D(1,1.16,4.95,3.82,4.95,3.82,8.52,1.16,8.52)"
}
]
Campos de API
Os seguintes campos de API dão suporte à segmentação na página:
| Campo | Tipo | Descrição |
|---|---|---|
ContentAnalyzerConfig.allowInPageSegments |
boolean |
Defina quando você cria ou atualiza um analisador personalizado. Quando true, os segmentos podem cobrir uma parte de uma página em vez de páginas completas. |
DocumentContentSegment.segmentId |
string |
Identificador estável para o segmento, como segment1. |
DocumentContentSegment.span |
Span |
offset e length do segmento dentro do texto de conteúdo pai no formato Markdown. |
DocumentContentSegment.confidence |
float32 |
Valor em [0–1]. Pontuação de confiança para segmentação e classificação de categoria. |
DocumentContentSegment.source |
SourceExpression |
Posição delimitadora do segmento na página, como uma expressão de polígono do formulário D(pageNumber, x1, y1, x2, y2, x3, y3, x4, y4). Passe esse valor como um range sub-analisador. |
Limites do classificador
Para obter informações sobre formatos de documento de entrada com suporte e limites de classificador, consulte cotas e limites de serviço.
Práticas recomendadas
Para melhorar a qualidade de classificação e divisão, use um bom nome de categoria e descrição para que o modelo possa entender as categorias com algum contexto. Para obter mais informações sobre nomes de categoria e descrições, consulte As práticas recomendadas.
Principais benefícios
- Precisão e confiabilidade: verifique a classificação precisa do documento para reduzir erros e aumentar a eficiência.
- Escalabilidade: dimensionar o processamento de documentos para atender às demandas comerciais.
- Personalizável: adapte o classificador de documento para ajustar fluxos de trabalho específicos.
Idiomas e regiões com suporte
Para obter uma lista de idiomas e regiões com suporte, consulte o suporte a idiomas e regiões.
Segurança e privacidade de dados
Se você usar o Content Understanding, examine as políticas da Microsoft sobre os dados do cliente. Para obter mais informações, consulte Dados, proteção e privacidade.
Conteúdo relacionado
- Tente processar o conteúdo do documento no Content Understanding Studio
- Saiba mais sobre como processar o conteúdo do documento usando modelos do analisador.