Modell för dokumentintelligens kvitton

Det här innehållet gäller för:🟩v4.0 (GA) | Tidigare versioner:🟦v3.1 (GA)🟥v3.0 (dras tillbaka)🟥v2.1 (dras tillbaka)

Det här innehållet gäller för:🟩v3.1 (GA) | Senaste versionen:🟪v4.0 (GA) | Tidigare versioner:🟦v3.0🟦v2.1

Det här innehållet gäller för:🟥v3.0 (dras tillbaka) | Senaste versioner:🟪v4.0 (GA)🟪v3.1 (GA) | Tidigare version:🟥v2.1 (dras tillbaka)

Det här innehållet gäller för:🟥v2.1 | Senaste versionen:🟪v4.0 (GA)

Kvittomodellen för dokumentinformation kombinerar kraftfulla OCR-funktioner (Optisk teckenigenkänning) med djupinlärningsmodeller för att analysera och extrahera viktig information från försäljningskvitton. Kvitton kan vara av olika format och kvalitet, inklusive tryckta och handskrivna kvitton. API:et extraherar viktig information som handelsnamn, handelstelefonnummer, transaktionsdatum, skatt och transaktionssumma och returnerar strukturerade JSON-data. Kvittomodell v4.0 (GA) stöder andra fält, inklusive ReceiptType, TaxDetails.NetAmount, TaxDetails.DescriptionTaxDetails.Rate och CountryRegion tillsammans med momstabellextrahering på allmänna hotellkvitton.

Extrahering av kvittodata

Kvitto digitalisering omfattar omvandlingen av olika typer av kvitton, inklusive skannade, fotograferade och tryckta kopior, till ett digitalt format för strömlinjeformad nedströmsbearbetning. Exempel är kostnadshantering, analys av konsumentbeteende, skatteautomation osv. Med hjälp av teknik för dokumentinformation med OCR (optisk teckenigenkänning) kan du extrahera och tolka data från dessa olika kvittoformat. Dokumentinformationsbearbetning förenklar konverteringsprocessen men minskar också avsevärt den tid och det arbete som krävs, vilket underlättar effektiv datahantering och hämtning.

Exempelkvitto som bearbetas med Document Intelligence Studio:

Skärmbild av ett exempelkvitto som bearbetas i Document Intelligence Studio.

Exempelkvitto som har bearbetats med Document Intelligence-verktyg för exemplaretikettering:

Skärmbild av ett exempelkvitto som bearbetats med verktyget Formulärexempeletiketter.

Utvecklingsalternativ

Document Intelligence v4.0: 2024-11-30 (GA) stöder följande verktyg, program och bibliotek:

Funktionen Resurser Modell-ID
Kvittomodell Document Intelligence Studio
REST API
C# SDK
Python SDK
Java SDK
JavaScript SDK
fördefinierat kvitto

Document Intelligence v3.1 stöder följande verktyg, program och bibliotek:

Funktionen Resurser Modell-ID
Kvittomodell Document Intelligence Studio
REST API
C# SDK
Python SDK
Java SDK
JavaScript SDK
fördefinierat kvitto

Document Intelligence v3.0 stöder följande verktyg, program och bibliotek:

Funktionen Resurser Modell-ID
Kvittomodell Document Intelligence Studio
REST API
C# SDK
Python SDK
Java SDK
JavaScript SDK
fördefinierat kvitto

Document Intelligence v2.1 stöder följande verktyg, program och bibliotek:

Funktionen Resurser
Kvittomodell Etikettverktyg
för dokumentinformation• REST API
Klientbiblioteks-SDK
Docker-container för dokumentinformation

Indatakrav

Följande filformat stöds.

Modell PDF Bild:
JPEG/JPG, PNG, BMP, TIFF, HEIF
Office:
Word (DOCX), Excel (XLSX), PowerPoint (PPTX), HTML
Läsa
Upplägg
Allmänt dokument
Förbyggda
Anpassad extrahering
Anpassad klassificering
  • Foton och genomsökningar: För bästa resultat, ge ett tydligt foto eller högkvalitativ genomsökning per dokument.
  • PDF-filer och TIFF:er: För PDF-filer och TIFF:er kan upp till 2 000 sidor bearbetas. (Med en prenumeration på den kostnadsfria nivån bearbetas endast de två första sidorna.)
  • Filstorlek: Filstorleken för att analysera dokument är 500 MB för den betalda nivån (S0) och 4 MB för den kostnadsfria nivån (F0).
  • Bilddimensioner: Dimensionerna måste vara mellan 50 bildpunkter x 50 bildpunkter och 10 000 bildpunkter x 10 000 bildpunkter.
  • Lösenordslås: Om dina PDF-filer är lösenordslåsta måste du ta bort låset innan det skickas in.
  • Texthöjd: Den minsta höjden på texten som ska extraheras är 12 bildpunkter för en bild på 1 024 x 768 bildpunkter. Den här dimensionen motsvarar cirka 8-punktstext vid 150 punkter per tum.
  • Anpassad modellträning: Det maximala antalet sidor för träningsdata är 500 för den anpassade mallmodellen och 50 000 för den anpassade neurala modellen.
  • Anpassad extraheringsmodellträning: Den totala storleken på träningsdata är 50 MB för mallmodellen och 1 GB för den neurala modellen.
  • Anpassad klassificeringsmodellträning: Den totala storleken på träningsdata är 1 GB med högst 10 000 sidor. För 2024-11-30 (GA) är den totala storleken på träningsdata 2 GB med högst 10 000 sidor.
  • Office-filtyper (DOCX, XLSX, PPTX): Den maximala stränglängdsgränsen är 8 miljoner tecken.
  • Filformat som stöds: JPEG, PNG, PDF och TIFF.
  • Sidtillägg som stöds för PDF och TIFF: Dokumentinformation kan bearbeta upp till 2 000 sidor för standardprenumeranter eller endast de två första sidorna för kostnadsfria prenumeranter.
  • Filstorlek som stöds: mindre än 50 MB; minsta bildpunkter 50 x 50 px; maximalt antal bildpunkter 10 000 x 10 000 px.

Extrahering av kvittomodelldata

Se hur Dokumentinformation extraherar data, inklusive tid och datum för transaktioner, handelsinformation och beloppssummor från kvitton. Du behöver följande resurser:

  • En Azure prenumeration – du kan skapa en kostnadsfri.

  • En Document Intelligence-instans i Azure-portalen. Du kan använda den kostnadsfria prisnivån (F0) för att prova tjänsten. När resursen har distribuerats väljer du Gå till resurs för att hämta din nyckel och slutpunkt.

Skärmbild av nycklar och slutpunktsplats i Azure portal.

Observera

Document Intelligence Studio är tillgängligt med v3.1- och v3.0-API:er och senare versioner.

  1. startsidan för Document Intelligence Studio väljer du Kvitton.

  2. Du kan analysera exempelkvittot eller ladda upp dina egna filer.

  3. Välj knappen Kör analys och konfigurera vid behov alternativen Analysera:

    Skärmbild av knapparna Kör analys och Analysera alternativ i Document Intelligence Studio.

Exempeletikettverktyg för dokumentinformation

  1. Gå till Document Intelligence Sample Tool.

  2. På exempelverktygets startsida väljer du panelen Använd fördefinierad modell för att hämta data .

    Skärmbild av layoutmodellen analyserar resultatprocessen.

  3. Välj den formulärtyp som ska analyseras från den nedrullningsbara menyn.

  4. Välj en URL för filen som du vill analysera från alternativen nedan:

  5. I fältet Källa väljer du URL på den nedrullningsbara menyn, klistrar in den valda URL:en och väljer knappen Hämta .

    Skärmbild av listruta för källplats.

  6. I fältet För dokumentinformationstjänstens slutpunkt klistrar du in slutpunkten som du fick med din Document Intelligence-prenumeration.

  7. I nyckelfältet klistrar du in den nyckel som du fick från dokumentinformationsresursen.

    Skärmbild av listrutan select-form-type.

  8. Välj Kör analys. Provverktyget för etikettering av dokumentinformation anropar det fördefinierade API:et Analyze och analyserar dokumentet.

  9. Visa resultaten – se nyckel/värde-par extraherade, radobjekt, markerad text som extraherats och tabeller har identifierats.

    Skärmbild av resultaten av analysoperationen för layoutmodellen.

Observera

Verktyget Exempeletiketter stöder inte BMP-filformatet. Det här är en begränsning för verktyget, inte dokumentunderrättelsetjänsten.

Språk och nationella inställningar som stöds

En fullständig lista över språk som stöds finns på sidanför språkstöd för fördefinierade modeller .

Fältextrahering

Information om vilka dokumentextraheringsfält som stöds finns på sidan receipt model schema på vår GitHub exempellagringsplats

Namn Typ Beskrivning Standardiserade utdata
KvittoTyp Sträng Typ av försäljningskvitto Specificerad
MerchantName Sträng Namnet på den handlare som utfärdar kvittot
Butikstelefonnummer telefonnummer Listat telefonnummer för säljare +1 xxx xxx xxxx
HandlareAdress Sträng Angiven adress till handlaren
Transaktionsdatum Datum Datum då kvittot utfärdades yyyy-mm-dd
Transaktionstid Tid Tid då kvittot utfärdades hh-mm-ss (24-timmarsformat)
Totala Nummer (USD) Fullständig transaktionssumma för kvitto Flyttal med två decimaler
Delsumma Nummer (USD) Delsumma av kvittot, ofta innan skatter tillämpas Flyttal med två decimaler
Skatt Nummer (USD) Total skatt vid kvitto (ofta moms eller motsvarande). Har bytt namn till "TotalTax" i 2022-06-30-versionen. Flyttal med två decimaler
Tips Nummer (USD) Dricks inkluderad av köparen Flyttal med två decimaler
Objekt Matris med objekt Extraherade radobjekt med namn, kvantitet, enhetspris och totalt pris extraherat
Namn Sträng Objektbeskrivning. Har bytt namn till "Description" i 2022-06-30-versionen.
Kvantitet Nummer Kvantitet för varje objekt Flyttal med två decimaler
Pris Nummer Individuellt pris för varje artikelenhet Flyttal med två decimaler
Totalpris Nummer Totalt pris för radartikel Flyttal med två decimaler

Migreringsguide och REST API v3.1

Nästa steg