本內容適用於:v2.1 | 版本最新版本:v4.0(通用版)
註
針對預先建構的身分證件(ID)模型,文件智慧 v4.0 2024-11-30 (GA) API 現已支援全球所有地區的身份證明文件,涵蓋北美、南美、亞洲、歐洲、非洲及大洋洲。
文件智慧身份證件(ID)模型結合光學字元辨識(OCR)與深度學習模型,以分析並提取身份證件中的關鍵資訊。 API 分析身份文件(包括以下文件),並回傳結構化的 JSON 資料表示。
| 區域 | 文件類型 |
|---|---|
| 全球 | 護照簿、護照卡 |
| 美國 | 駕照、身分證、居留許可(綠卡)、社會安全卡、軍人證 |
| 印度 | 駕照、公共安全卡、Aadhaar卡 |
| 澳洲 | 駕照、照片卡、鑰匙通行證證(含數位版) |
| 其他 | 駕照、身分證、居留許可 |
Document Intelligence 能利用其預先建構的 ID 模型,分析並提取政府核發的身分證(ID)資訊。 它結合我們強大的 光學字元辨識(OCR) 能力與身份識別功能,從全球護照及美國駕照(全美50州及華盛頓特區)中擷取關鍵資訊。 IDs API 會從這些身份文件中擷取關鍵資訊,例如名字、姓氏、出生日期、文件編號等。 此 API 以雲端服務形式提供於文件智慧 v2.1 中。
身分證件處理
身份證件處理涉及手動或使用基於OCR技術的身份證件資料擷取。 身分證文件處理是任何需要身份證明的商業運作中的重要步驟。 例如銀行及其他金融機構的客戶驗證、房貸申請、醫療訪視、理賠處理、餐旅業等。 個人需透過駕照、護照及其他類似文件提供部分身份證明,以便企業在提供服務與福利前有效驗證。
美國駕照範例,由 Document Intelligence Studio 處理
資料擷取
預先建構的身分證服務會從全球護照和美國駕照中擷取關鍵值,並以有組織的結構化 JSON 回應方式回傳。
駕照範例
護照範例
開發選項
文件智慧 v4.0: 2024-11-30 (通用版)支援以下工具、應用程式與函式庫:
| 特色 | 資源 | 型號識別碼 |
|---|---|---|
| ID 文件模型 | • 文件智慧工作室 • REST API • C# SDK • Python SDK • Java SDK • JavaScript SDK |
prebuilt-idDocument |
文件智慧 v3.1 支援以下工具、應用程式與函式庫:
| 特色 | 資源 | 型號識別碼 |
|---|---|---|
| ID 文件模型 | • 文件智慧工作室 • REST API • C# SDK • Python SDK • Java SDK • JavaScript SDK |
prebuilt-idDocument |
文件智慧 v3.0 支援以下工具、應用程式與函式庫:
| 特色 | 資源 | 型號識別碼 |
|---|---|---|
| ID 文件模型 | • 文件智慧工作室 • REST API • C# SDK • Python SDK • Java SDK • JavaScript SDK |
prebuilt-idDocument |
文件智慧 v2.1 支援以下工具、應用程式與函式庫:
| 特色 | 資源 |
|---|---|
| ID 文件模型 | • 文件智慧標註工具 • REST API • 客戶端函式庫 SDK • 文件智慧 Docker 容器 |
輸入需求
支援以下檔案格式。
| 模型 | 圖片來源: JPEG/JPG、PNG、BMP、TIFF、HEIF |
Office: Word(DOCX)、Excel(XLSX)、PowerPoint(PPTX)、HTML |
|
|---|---|---|---|
| 閱讀 | ✔ | ✔ | ✔ |
| 版面配置 | ✔ | ✔ | ✔ |
| 一般文件 | ✔ | ✔ | |
| 預先建置 | ✔ | ✔ | |
| 自訂擷取 | ✔ | ✔ | |
| 自訂分類 | ✔ | ✔ | ✔ |
- 照片與掃描:為取得最佳效果,請每份文件提供一張清晰照片或高品質掃描。
- PDF 與 TIFF:PDF 與 TIFF 最多可處理 2,000 頁。 (免費訂閱則只會處理前兩頁。)
- 檔案大小:用於分析文件的檔案大小為付費(S0)等級為 500 MB,免費(F0)等級為 4 MB。
- 影像尺寸:尺寸必須介於50像素 x 50像素到10,000像素 x 10,000像素之間。
- 密碼鎖定:如果您的 PDF 有密碼鎖定,提交前必須解除鎖定。
- 文字高度:1024 x 768 像素的影像中,需擷取的文字最小高度為 12 像素。 這個尺寸相當於約 8 點字,每英吋 150 點。
- 自訂模型訓練:自訂範本模型的最大訓練頁面數為 500 頁,自訂神經模型為 50,000 頁。
- 自訂擷取模型訓練:模板模型的訓練資料總大小為 50 MB,神經模型為 1 GB。
- 自訂分類模型訓練:訓練資料總大小為 1 GB,最多可達 10,000 頁。 2024-11-30(通用時間)訓練資料總大小為 2 GB,最大可達 10,000 頁。
- Office 檔案類型(DOCX、XLSX、PPTX):字串長度上限為 800 萬字元。
支援的檔案格式:JPEG、PNG、PDF 及 TIFF。
PDF 與 TIFF 檔案的支援頁數:最多 2,000 頁,免費訂閱者僅支援前兩頁。
支援檔案大小:總共少於 50 MB;最小像素:50 x 50 像素;最大像素 10,000 x 10,000 像素。
身份證件模型資料擷取
從身分證文件中擷取資料,包括姓名、出生日期及有效日期。 你需要以下資源:
註
文件智慧工作室提供 v3.1 與 v3.0 API 及更新版本。
在 文件智慧工作室首頁,選擇 「身份文件」。
你可以分析發票範本或上傳自己的檔案。
選擇 執行分析 按鈕,必要時設定 分析選項:
文件智能範例標籤工具
請導航至文件智慧範例工具。
在範例工具首頁,選擇 「使用預建模型以取得資料 圖塊」。
從下拉選單選擇 表單類型 以供分析。
請從以下選項中選擇你想分析的檔案網址:
在 來源 欄位,從下拉選單選擇 URL ,貼上所選 URL,然後選擇 擷取 按鈕。
在 文件智慧服務端點 欄位,貼上你透過文件智慧訂閱取得的端點。
在 關鍵 欄位,貼上你從文件智慧資源取得的鑰匙。
選擇 執行分析。 文件智慧範例標籤工具會呼叫 Analyze Prebuilt API,並分析文件。
查看結果——查看擷取的鍵值對、行項目、被選取的文字,以及偵測到的資料表。
下載 JSON 輸出檔案以查看詳細結果。
- "readResults" 節點包含每一行文字,以及其在頁面上的對應邊界框位置。
- 「selectionMarks」節點顯示每個選取標記(勾選框、無線電標記)及其狀態是否 被選取 或 未選取。
- 「pageResults」區塊包含擷取的資料表。 對於每個表格,文件智能會擷取文字、列和欄的索引、列與欄的跨越、邊界框等資料。
- 「documentResults」欄位包含文件中最相關部分的鍵值對資訊及行項資訊。
註
範例 標籤工具 不支援 BMP 檔案格式。 這項限制是工具本身的限制,而非文件情報服務本身。
欄位擷取
關於支援的文件擷取欄位,<請參考我們GitHub範例庫中的
支援的文件類型
目前的身分證文件模式支援美國駕照及國際護照(不含簽證及其他旅行文件)的個人資料頁擷取。
已擷取的欄位
| 名稱 | 類型 | 描述 | 價值 |
|---|---|---|---|
| 國家 | 國家 | 符合 ISO 3166 標準的國家代碼 | 「美國」 |
| 出生日期 | 日期 | 出生日期(YYYY-MM-DD 格式) | "1980-01-01" |
| 到期日 | 日期 | 到期日的格式為 YYYY-MM-DD | "2019-05-05" |
| 文件編號 | 字串 | 相關的護照號碼、駕照號碼等等。 | "340020013" |
| FirstName | 字串 | 若適用,請提取名字與中間名的首字母。 | 「珍妮佛」 |
| 姓氏 | 字串 | 摘錄的姓氏 | 「布魯克斯」 |
| 國籍 | 國家 | 符合 ISO 3166 標準的國家代碼 | 「美國」 |
| 性 | 性別 | 可能提取的值包括「M」、「F」、「X」。 | 「F」 |
| 機器可讀區 | 物件 | 擷取的護照MRZ,包含兩行 (每行44個字元)。 |
「P<USABROOKS<<珍妮佛<<<<<<<<<<<<<<<<<<<<<<<<3400200135USA8001014F1905054710000307 715816」 |
| 文件類型 | 字串 | 文件類型,例如護照、駕照 | 「護照」 |
| 地址 | 字串 | 擷取的地址 (僅限駕照) | "123 STREET ADDRESS YOUR CITY WA 99999-1234" |
| 區域 | 字串 | 擷取的地區、州、省等(僅限駕照) | 「華盛頓」 |
遷徙指南
- 請遵循我們的 文件智慧 v3.1 遷移指南 ,了解如何在您的應用程式與工作流程中使用 v3.0 版本。
下一步
試著用 文件智慧工作室處理你自己的表單和文件。
完成 一份文件智慧快速入門 ,並開始用你選擇的開發語言創建文件處理應用程式。
試著用 文件智慧範例標籤工具處理你自己的表單和文件。
完成 一份文件智慧快速入門 ,並開始用你選擇的開發語言創建文件處理應用程式。