文件智慧識別文件模型

本內容適用於:v4.0(通用版) | 先前版本:v3.1(通用版)v3.0(退役)V2.1(退役)

本內容適用於:v3.1 (GA) | 最新版本:v4.0 (GA) | 先前版本:v3.0v2.1

本內容適用於:v3.0(退役) | 最新版本:v4.0(通用版)v3.1(通用版) | 先前版本:V2.1(退役)

本內容適用於:v2.1 | 版本最新版本:v4.0(通用版)

註

針對預先建構的身分證件(ID)模型,文件智慧 v4.0 2024-11-30 (GA) API 現已支援全球所有地區的身份證明文件,涵蓋北美、南美、亞洲、歐洲、非洲及大洋洲。

文件智慧身份證件(ID)模型結合光學字元辨識(OCR)與深度學習模型,以分析並提取身份證件中的關鍵資訊。 API 分析身份文件(包括以下文件),並回傳結構化的 JSON 資料表示。

區域 文件類型
全球 護照簿、護照卡
美國 駕照、身分證、居留許可(綠卡)、社會安全卡、軍人證
印度 駕照、公共安全卡、Aadhaar卡
澳洲 駕照、照片卡、鑰匙通行證證(含數位版)
其他 駕照、身分證、居留許可

Document Intelligence 能利用其預先建構的 ID 模型,分析並提取政府核發的身分證(ID)資訊。 它結合我們強大的 光學字元辨識(OCR) 能力與身份識別功能,從全球護照及美國駕照(全美50州及華盛頓特區)中擷取關鍵資訊。 IDs API 會從這些身份文件中擷取關鍵資訊,例如名字、姓氏、出生日期、文件編號等。 此 API 以雲端服務形式提供於文件智慧 v2.1 中。

身分證件處理

身份證件處理涉及手動或使用基於OCR技術的身份證件資料擷取。 身分證文件處理是任何需要身份證明的商業運作中的重要步驟。 例如銀行及其他金融機構的客戶驗證、房貸申請、醫療訪視、理賠處理、餐旅業等。 個人需透過駕照、護照及其他類似文件提供部分身份證明,以便企業在提供服務與福利前有效驗證。

美國駕照範例,由 Document Intelligence Studio 處理

示範駕照圖片。

資料擷取

預先建構的身分證服務會從全球護照和美國駕照中擷取關鍵值,並以有組織的結構化 JSON 回應方式回傳。

駕照範例

駕照範例

護照範例

護照範例

開發選項

文件智慧 v4.0: 2024-11-30 (通用版)支援以下工具、應用程式與函式庫:

特色 資源 型號識別碼
ID 文件模型 • 文件智慧工作室
• REST API
• C# SDK
• Python SDK
• Java SDK
• JavaScript SDK
prebuilt-idDocument

文件智慧 v3.1 支援以下工具、應用程式與函式庫:

特色 資源 型號識別碼
ID 文件模型 • 文件智慧工作室
• REST API
• C# SDK
• Python SDK
• Java SDK
• JavaScript SDK
prebuilt-idDocument

文件智慧 v3.0 支援以下工具、應用程式與函式庫:

特色 資源 型號識別碼
ID 文件模型 • 文件智慧工作室
• REST API
• C# SDK
• Python SDK
• Java SDK
• JavaScript SDK
prebuilt-idDocument

文件智慧 v2.1 支援以下工具、應用程式與函式庫:

特色 資源
ID 文件模型 • 文件智慧標註工具
• REST API
• 客戶端函式庫 SDK
• 文件智慧 Docker 容器

輸入需求

支援以下檔案格式。

模型 PDF 圖片來源:
JPEG/JPG、PNG、BMP、TIFF、HEIF
Office:
Word(DOCX)、Excel(XLSX)、PowerPoint(PPTX)、HTML
閱讀 ✔ ✔ ✔
版面配置 ✔ ✔ ✔
一般文件 ✔ ✔
預先建置 ✔ ✔
自訂擷取 ✔ ✔
自訂分類 ✔ ✔ ✔
  • 照片與掃描:為取得最佳效果,請每份文件提供一張清晰照片或高品質掃描。
  • PDF 與 TIFF:PDF 與 TIFF 最多可處理 2,000 頁。 (免費訂閱則只會處理前兩頁。)
  • 檔案大小:用於分析文件的檔案大小為付費(S0)等級為 500 MB,免費(F0)等級為 4 MB。
  • 影像尺寸:尺寸必須介於50像素 x 50像素到10,000像素 x 10,000像素之間。
  • 密碼鎖定:如果您的 PDF 有密碼鎖定,提交前必須解除鎖定。
  • 文字高度:1024 x 768 像素的影像中,需擷取的文字最小高度為 12 像素。 這個尺寸相當於約 8 點字,每英吋 150 點。
  • 自訂模型訓練:自訂範本模型的最大訓練頁面數為 500 頁,自訂神經模型為 50,000 頁。
  • 自訂擷取模型訓練:模板模型的訓練資料總大小為 50 MB,神經模型為 1 GB。
  • 自訂分類模型訓練:訓練資料總大小為 1 GB,最多可達 10,000 頁。 2024-11-30(通用時間)訓練資料總大小為 2 GB,最大可達 10,000 頁。
  • Office 檔案類型(DOCX、XLSX、PPTX):字串長度上限為 800 萬字元。
  • 支援的檔案格式:JPEG、PNG、PDF 及 TIFF。

  • PDF 與 TIFF 檔案的支援頁數:最多 2,000 頁,免費訂閱者僅支援前兩頁。

  • 支援檔案大小:總共少於 50 MB;最小像素:50 x 50 像素;最大像素 10,000 x 10,000 像素。

身份證件模型資料擷取

從身分證文件中擷取資料,包括姓名、出生日期及有效日期。 你需要以下資源:

  • Azure訂閱——你可以免費創建。

  • Azure入口網站中的一個文件智慧實例。 你可以使用免費價格層級(F0)來試用這項服務。 資源部署完成後,選擇 前往資源 以取得你的金鑰和端點。

Azure入口中金鑰與端點位置的截圖。

註

文件智慧工作室提供 v3.1 與 v3.0 API 及更新版本。

  1. 在 文件智慧工作室首頁,選擇 「身份文件」。

  2. 你可以分析發票範本或上傳自己的檔案。

  3. 選擇 執行分析 按鈕,必要時設定 分析選項:

    文件智慧工作室中執行分析與分析選項按鈕的截圖。

文件智能範例標籤工具

  1. 請導航至文件智慧範例工具。

  2. 在範例工具首頁,選擇 「使用預建模型以取得資料 圖塊」。

    佈局模型分析結果操作的截圖。

  3. 從下拉選單選擇 表單類型 以供分析。

  4. 請從以下選項中選擇你想分析的檔案網址:

  5. 在 來源 欄位,從下拉選單選擇 URL ,貼上所選 URL,然後選擇 擷取 按鈕。

    來源位置下拉選單的截圖。

  6. 在 文件智慧服務端點 欄位,貼上你透過文件智慧訂閱取得的端點。

  7. 在 關鍵 欄位,貼上你從文件智慧資源取得的鑰匙。

    選擇文件類型下拉選單的截圖。

  8. 選擇 執行分析。 文件智慧範例標籤工具會呼叫 Analyze Prebuilt API,並分析文件。

  9. 查看結果——查看擷取的鍵值對、行項目、被選取的文字,以及偵測到的資料表。

    身份模型分析結果操作的截圖。

  10. 下載 JSON 輸出檔案以查看詳細結果。

    • "readResults" 節點包含每一行文字,以及其在頁面上的對應邊界框位置。
    • 「selectionMarks」節點顯示每個選取標記(勾選框、無線電標記)及其狀態是否 被選取 或 未選取。
    • 「pageResults」區塊包含擷取的資料表。 對於每個表格,文件智能會擷取文字、列和欄的索引、列與欄的跨越、邊界框等資料。
    • 「documentResults」欄位包含文件中最相關部分的鍵值對資訊及行項資訊。

註

範例 標籤工具 不支援 BMP 檔案格式。 這項限制是工具本身的限制,而非文件情報服務本身。

欄位擷取

關於支援的文件擷取欄位,<請參考我們GitHub範例庫中的<>>ID 文件模型 schema頁面。

支援的文件類型

目前的身分證文件模式支援美國駕照及國際護照(不含簽證及其他旅行文件)的個人資料頁擷取。

已擷取的欄位

名稱 類型 描述 價值
國家 國家 符合 ISO 3166 標準的國家代碼 「美國」
出生日期 日期 出生日期(YYYY-MM-DD 格式) "1980-01-01"
到期日 日期 到期日的格式為 YYYY-MM-DD "2019-05-05"
文件編號 字串 相關的護照號碼、駕照號碼等等。 "340020013"
FirstName 字串 若適用,請提取名字與中間名的首字母。 「珍妮佛」
姓氏 字串 摘錄的姓氏 「布魯克斯」
國籍 國家 符合 ISO 3166 標準的國家代碼 「美國」
性 性別 可能提取的值包括「M」、「F」、「X」。 「F」
機器可讀區 物件 擷取的護照MRZ,包含兩行 (每行44個字元)。 「P<USABROOKS<<珍妮佛<<<<<<<<<<<<<<<<<<<<<<<<3400200135USA8001014F1905054710000307 715816」
文件類型 字串 文件類型,例如護照、駕照 「護照」
地址 字串 擷取的地址 (僅限駕照) "123 STREET ADDRESS YOUR CITY WA 99999-1234"
區域 字串 擷取的地區、州、省等(僅限駕照) 「華盛頓」

遷徙指南

下一步