Modelo de contrato de Inteligência Documental

Este conteúdo aplica-se ao seguinte:🟩v4.0 (GA) | Versões anteriores:🟦v3.1 (GA)🟥v3.0 (descontinuada em breve)🟥v2.1 (descontinuada em breve)

Este conteúdo aplica-se a:🟩v3.1 (GA) | Versão mais recente:🟪v4.0 (GA)

Este conteúdo aplica-se a:🟥v3.0 (descontinuada) | Versão mais recente:🟪v4.0 (GA)

O modelo de contrato de Inteligência Documental usa poderosos recursos de Reconhecimento Ótico de Caracteres (OCR) para analisar e extrair campos-chave e itens de linha de um grupo selecionado de entidades contratuais importantes. Os contratos podem ser de vários formatos e qualidade, incluindo imagens capturadas por telefone, documentos digitalizados e PDFs digitais. A API analisa o texto do documento; extrai informações importantes, como Partes, Jurisdições, ID do Contrato e Título; e retorna uma representação de dados JSON estruturada. Atualmente, o modelo suporta formatos de documentos em inglês.

Tratamento automatizado de contratos

O processamento automatizado de contratos é o processo de extração de campos-chave do contrato a partir de documentos. Historicamente, o processo de análise de contratos é realizado manualmente e, portanto, muito demorado. A extração precisa de dados-chave de contratos é normalmente a primeira e uma das etapas mais críticas no processo de automação de contratos.

Opções de desenvolvimento

O Document Intelligence v4.0: 2024-11-30 (GA) suporta as seguintes ferramentas, aplicações e bibliotecas:

Caraterística Recursos ID do modelo
Modelo de contrato Document Intelligence Studio• REST API• C# SDK• Python SDK• Java SDK• JavaScript SDK contrato pré-configurado

O Document Intelligence v3.1 suporta as seguintes ferramentas, aplicativos e bibliotecas:

Caraterística Recursos ID do modelo
Modelo de contrato Document Intelligence Studio• REST API• C# SDK• Python SDK• Java SDK• JavaScript SDK contrato predefinido

O Document Intelligence v3.0 suporta as seguintes ferramentas, aplicações e bibliotecas:

Caraterística Recursos ID do modelo
Modelo de contrato Document Intelligence Studio• REST API• C# SDK• Python SDK• Java SDK• JavaScript SDK contrato pré-configurado

Requisitos de entrada

Os seguintes formatos de ficheiro são suportados.

Modelo PDF Imagem:
JPEG/JPG, PNG, BMP, TIFF, HEIF
Microsoft Office:
Word (DOCX), Excel (XLSX), PowerPoint (PPTX), HTML
Ler
Esquema
Documento geral
Pré-construído
Extração personalizada
Classificação personalizada
  • Fotos e digitalizações: para obter melhores resultados, forneça uma foto nítida ou uma digitalização de alta qualidade por documento.
  • PDFs e TIFFs: Para PDFs e TIFFs, até 2.000 páginas podem ser processadas. (Com uma assinatura de nível gratuito, apenas as duas primeiras páginas são processadas.)
  • Tamanho do arquivo: O tamanho do arquivo para analisar documentos é de 500 MB para a camada paga (S0) e 4 MB para a camada gratuita (F0).
  • Dimensões da imagem: As dimensões devem estar entre 50 pixels x 50 pixels e 10.000 pixels x 10.000 pixels.
  • Bloqueios de senha: se seus PDFs estiverem bloqueados por senha, você deverá remover o bloqueio antes do envio.
  • Altura do texto: a altura mínima do texto a ser extraído é de 12 pixels para uma imagem de 1024 x 768 pixels. Esta dimensão corresponde a um texto de cerca de 8 pontos a 150 pontos por polegada.
  • Treinamento de modelo personalizado: o número máximo de páginas para dados de treinamento é 500 para o modelo de modelo personalizado e 50.000 para o modelo neural personalizado.
  • Treinamento de modelo de extração personalizado: O tamanho total dos dados de treinamento é de 50 MB para o modelo de modelo e 1 GB para o modelo neural.
  • Treinamento de modelo de classificação personalizado: o tamanho total dos dados de treinamento é de 1 GB com um máximo de 10.000 páginas. Para 2024-11-30 (GA), o tamanho total dos dados de treinamento é de 2 GB com um máximo de 10.000 páginas.
  • Tipos de ficheiro do Office (DOCX, XLSX, PPTX): O limite máximo de comprimento de cadeia de caracteres é de 8 milhões de caracteres.

Experimente a extração de dados de documentos de contrato

Veja como os dados, incluindo informações do cliente, detalhes do fornecedor e itens de linha, são extraídos dos contratos. Você precisa dos seguintes recursos:

  • Uma assinatura do Azure — você pode criar uma gratuitamente.

  • Uma instância de Document Intelligence no portal do Azure. Você pode usar o nível de preço gratuito (F0) para experimentar o serviço. Depois de o recurso ser implementado, selecione Ir para o recurso para obter a sua chave e o ponto final.

Captura de ecrã das chaves e da localização do ponto final no portal do Azure.

Estúdio de Inteligência de Documentação

  1. Na página inicial do Document Intelligence Studio, selecione Documentos fiscais.

  2. Você pode analisar os documentos fiscais de exemplo ou fazer upload de seus próprios arquivos.

  3. Selecione o botão Executar análise e, se necessário, configure as opções Analisar:

    Captura de tela dos botões Executar análise e Analisar opções no Document Intelligence Studio.

Idiomas e localidades suportados

Para obter uma lista completa dos idiomas suportados, consulte a nossa página Suporte a idiomas — modelos pré-construídos.

Extração de campo

  • Para os campos de extração de documentos suportados, consulte a página esquema do modelo de contrato no nosso repositório de exemplos no GitHub.

  • Os pares chave-valor do contrato e os itens de linha extraídos encontram-se na secção documentResults da saída em JSON.

Próximos passos