Vad är Azure Document Intelligence?
Tips/Råd
Mer information finns på fliken Text och bilder !
Azure Document Intelligence är en molnbaserad AI-tjänst i Microsoft Foundry som använder OCR- och djupinlärningsmodeller för att extrahera text, nyckel/värde-par, urvalsmarkeringar och tabeller från dokument.
OCR avbildar dokumentstrukturen genom att skapa avgränsningsrutor runt identifierade objekt i en bild. Platserna för avgränsningsrutorna registreras som koordinater i förhållande till resten av sidan. Azure Document Intelligence returnerar avgränsningsboxdata och annan information i ett strukturerat JSON-format som bevarar relationerna från det ursprungliga dokumentet.
För att skapa en modell för dokumentextrahering med hög noggrannhet från grunden krävs djupinlärningsexpertis, stora mängder beräkning och långa träningstider. Azure Document Intelligence tillhandahåller underliggande modeller som redan tränats på tusentals formulärexempel, så att du kan uppnå dataextrahering med hög noggrannhet med minimal ansträngning.
Komponenter i Document Intelligence-tjänsten
Azure Document Intelligence består av tre kategorier av modeller:
Modeller för dokumentanalys: Extrahera text, struktur, tabeller och urvalsmarkeringar från dokument. Läsmodellen extraherar text och identifierar språk, medan layoutmodellen lägger till extrahering av tabeller och strukturer. Du kommer att utforska dessa modeller i detalj i enheten Använd fördefinierade modeller .
Fördefinierade modeller: Extrahera information från vanliga dokumenttyper – till exempel fakturor, kvitton, skatteformulär, ID-dokument med mera – utan någon utbildning som krävs. Du ser en fullständig lista över tillgängliga fördefinierade modeller i enheten Använd fördefinierade modeller .
Anpassade modeller: Extrahera data från formulär som är specifika för ditt företag med dina egna märkta datauppsättningar. Alternativen omfattar anpassade mallmodeller (snabba och kostnadseffektiva för fasta layouter), anpassade neurala modeller (högre noggrannhet för olika layouter), sammansatta modeller och anpassade klassificerare. Du får lära dig mer om träning och användning av anpassade modeller i lektionen Träna och använda anpassade modeller .
Åtkomst till dokumentinformationstjänster
Du kan komma åt Azure Document Intelligence på flera sätt:
- REST API: Anropa tjänsten direkt med HJÄLP av HTTP-begäranden.
- SDK:er för klientbibliotek: Använd SDK:er för Python, C#, Java och JavaScript.
- Document Intelligence Studio: Ett onlineverktyg för att visuellt utforska, testa och skapa dokumentinformationslösningar.
- Microsoft Foundry-portalen: Integrera dokumentinformation med andra Foundry-verktyg.
Tips/Råd
Den här modulens övning fokuserar på Python SDK. De underliggande REST-tjänsterna kan användas av vilket språk som helst.
Skapa en dokumentinformationsresurs
Om du vill använda Azure Document Intelligence behöver du en Azure-resurs. Du kan använda något av följande:
- En Foundry-resurs: En prenumeration som erbjuder flera tjänster och ger tillgång till flera AI-tjänster under en enda slutpunkt och nyckel.
- En Azure Document Intelligence-resurs: En resurs med en enda tjänst som endast används med Dokumentinformation.
Anmärkning
Skapa en Foundry-resurs om du planerar att komma åt flera Foundry-verktyg under en enda slutpunkt och nyckel. För endast åtkomst till dokumentinformation skapar du en dedikerad dokumentinformationsresurs.
Inmatningskrav
Azure Document Intelligence fungerar på indatadokument som uppfyller dessa krav:
- Formatet måste vara JPEG, PNG, BMP, PDF (text eller skannad) eller TIFF. Läsmodellen accepterar även Microsoft Office-filformat.
- Filstorleken måste vara mindre än 500 MB för standardnivån och 4 MB för den kostnadsfria nivån.
- Bilddimensionerna måste vara mellan 50 × 50 bildpunkter och 10 000 × 10 000 bildpunkter.
- PDF-dokument måste ha dimensioner som är mindre än 17 x 17 tum (A3-pappersstorlek).
- PDF-dokument får inte vara lösenordsskyddade.