Document Intelligence-model voor bankafschriften

Deze inhoud is van toepassing op: 🟩 v4.0 (GA)

Het document intelligence bankafschriftmodel combineert krachtige OCR-mogelijkheden (Optical Character Recognition) met deep learning-modellen voor het analyseren en extraheren van gegevens uit Amerikaanse bankafschriften. De API analyseert afgedrukte bankafschriften; haalt belangrijke informatie op, zoals rekeningnummer, bankgegevens, afschriftgegevens, transactiegegevens en kosten; en retourneert een gestructureerde JSON-gegevensweergave. Met V4.0 GA kunt u nu controletabellen extraheren in de Amerikaanse bankafschriften.

Functie versie Model-ID
Bankafschriftmodel v4.0: 2024-11-30 (GA) prebuilt-bankStatement.us

Gegevensextractie van bankafschriften

Een bankoverzicht helpt bij het controleren van de activiteiten van een rekening tijdens een opgegeven periode. Het is een officiële verklaring die helpt bij het detecteren van fraude, het bijhouden van uitgaven, boekhoudfouten en het vastleggen van de activiteiten van de periode. Bekijk hoe gegevens worden geëxtraheerd met behulp van het prebuilt-bankStatement.us model. U hebt de volgende resources nodig:

  • Een Azure-abonnement: u kunt er gratis een maken

  • Een Document Intelligence-exemplaar in Azure Portal. U kunt de gratis prijscategorie (F0) gebruiken om de service te proberen. Nadat uw resource is geïmplementeerd, selecteert u Ga naar de resource om uw sleutel en eindpunt op te halen.

    Schermopname van sleutels en eindpuntlocatie in Azure Portal.

Document Intelligence Studio

  1. Selecteer bankafschriften op de startpagina van Document Intelligence Studio.

  2. U kunt het voorbeeld van een bankoverzicht analyseren of uw eigen bestanden uploaden.

  3. Selecteer de knop Analyse uitvoeren en configureer indien nodig de opties Analyseren:

    Schermopname van de knoppen Analyse uitvoeren en Opties analyseren in Document Intelligence Studio.

Vereisten voor invoer

De volgende bestandsindelingen worden ondersteund.

Modelleren PDF Afbeelding:
JPEG/JPG, PNG, BMP, TIFF, HEIF
Office:
Word (DOCX), Excel (XLSX), PowerPoint (PPTX), HTML
Lezen
Indeling
Algemeen document
Vooraf gebouwd
Aangepaste extractie
Aangepaste classificatie
  • Foto's en scans: geef één duidelijke foto of een hoogwaardige scan per document op voor de beste resultaten.
  • PDF's en TIFF's: Voor PDF-bestanden en TIFF's kunnen maximaal 2000 pagina's worden verwerkt. (Met een abonnement op de gratis laag worden alleen de eerste twee pagina's verwerkt.)
  • Bestandsgrootte: de bestandsgrootte voor het analyseren van documenten is 500 MB voor de betaalde laag (S0) en 4 MB voor de gratis laag (F0).
  • Afbeeldingsafmetingen: De afmetingen moeten tussen 50 pixels x 50 pixels en 10.000 pixels x 10.000 pixels zijn.
  • Wachtwoordvergrendelingen: als uw PDF-bestanden zijn vergrendeld met een wachtwoord, moet u de vergrendeling verwijderen voordat u ze inzendt.
  • Teksthoogte: de minimale hoogte van de tekst die moet worden geëxtraheerd, is 12 pixels voor een afbeelding van 1024 x 768 pixels. Deze dimensie komt overeen met ongeveer 8-punts tekst bij 150 punten per inch.
  • Aangepaste modeltraining: Het maximum aantal pagina's voor trainingsgegevens is 500 voor het aangepaste sjabloonmodel en 50.000 voor het aangepaste neurale model.
  • Aangepaste extractiemodeltraining: de totale grootte van trainingsgegevens is 50 MB voor het sjabloonmodel en 1 GB voor het neurale model.
  • Training voor aangepast classificatiemodel: de totale grootte van trainingsgegevens is 1 GB met maximaal 10.000 pagina's. Voor 2024-11-30 (GA) is de totale grootte van trainingsgegevens 2 GB met maximaal 10.000 pagina's.
  • Office-bestandstypen (DOCX, XLSX, PPTX): de maximale tekenreekslengte is 8 miljoen tekens.

Ondersteunde talen en landinstellingen

Zie onze pagina voor vooraf samengestelde modeltaalondersteuning voor een volledige lijst met ondersteunde talen.

Extractie van velden

Voor ondersteunde documentextractievelden zie de pagina over het schema van het bankafschriftmodel in onze GitHub-voorbeeldrepository.

Ondersteunde talen en regio's

De prebuilt-bankStatement.us versie 2027-11-30 ondersteunt de landinstelling en-us .

Volgende stappen

  • Probeer uw eigen formulieren en documenten te verwerken met Document Intelligence Studio

  • Voltooi een quickstart voor Document Intelligence en ga aan de slag met het maken van een app voor documentverwerking in de ontwikkeltaal van uw keuze.