本內容適用於:v2.1 | 版本最新版本:v4.0(通用版)
文件智慧發票模型利用強大的光學字元辨識(OCR)功能,分析並提取銷售發票、水電帳單及採購訂單中的關鍵欄位與項目。 發票格式與品質各異,包括手機拍攝的影像、掃描文件及數位PDF。 API 分析發票文字;擷取關鍵資訊,如客戶姓名、帳單地址、到期日及應付金額;並回傳結構化的 JSON 資料表示。 該模型目前支援 27 種語言的發票。
支援的文件類型:
- 發票
- 水電費
- 銷售訂單
- 採購訂單
自動發票處理
自動發票處理是從帳單帳戶文件中提取關鍵 accounts payable 欄位的過程。 擷取的資料包括與應付帳款(AP)工作流程整合的發票明細項,這些數據用於進行審查和付款。 過去,應付帳款流程是手動完成的,因此非常耗時。 從發票中準確提取關鍵資料通常是發票自動化流程中最重要且最關鍵的步驟之一。
使用 Document Intelligence Studio 處理的發票範例:
使用文件智慧範例標籤工具處理的範例發票:
開發選項
文件智慧 v4.0: 2024-11-30 (通用版)支援以下工具、應用程式與函式庫:
| 特色 | 資源 | 型號識別碼 |
|---|---|---|
| 發票模型 | • 文件智慧工作室 • REST API • C# SDK • Python SDK • Java SDK • JavaScript SDK |
預建發票 |
文件智慧 v3.1 支援以下工具、應用程式與函式庫:
| 特色 | 資源 | 型號識別碼 |
|---|---|---|
| 發票模型 | • 文件智慧工作室 • REST API • C# SDK • Python SDK • Java SDK • JavaScript SDK |
預建發票 |
文件智慧 v3.0 支援以下工具、應用程式與函式庫:
| 特色 | 資源 | 型號識別碼 |
|---|---|---|
| 發票模型 | • 文件智慧工作室 • REST API • C# SDK • Python SDK • Java SDK • JavaScript SDK |
預建發票 |
文件智慧 v2.1 支援以下工具、應用程式與函式庫:
| 特色 | 資源 |
|---|---|
| 發票模型 | • 文件智慧標註工具 • REST API • 客戶端函式庫 SDK • 文件智慧 Docker 容器 |
輸入需求
支援以下檔案格式。
| 模型 | 圖片來源: JPEG/JPG、PNG、BMP、TIFF、HEIF |
Office: Word(DOCX)、Excel(XLSX)、PowerPoint(PPTX)、HTML |
|
|---|---|---|---|
| 閱讀 | ✔ | ✔ | ✔ |
| 版面配置 | ✔ | ✔ | ✔ |
| 一般文件 | ✔ | ✔ | |
| 預先建置 | ✔ | ✔ | |
| 自訂擷取 | ✔ | ✔ | |
| 自訂分類 | ✔ | ✔ | ✔ |
- 照片與掃描:為取得最佳效果,請每份文件提供一張清晰照片或高品質掃描。
- PDF 與 TIFF:PDF 與 TIFF 最多可處理 2,000 頁。 (免費訂閱則只會處理前兩頁。)
- 檔案大小:用於分析文件的檔案大小為付費(S0)等級為 500 MB,免費(F0)等級為 4 MB。
- 影像尺寸:尺寸必須介於50像素 x 50像素到10,000像素 x 10,000像素之間。
- 密碼鎖定:如果您的 PDF 有密碼鎖定,提交前必須解除鎖定。
- 文字高度:1024 x 768 像素的影像中,需擷取的文字最小高度為 12 像素。 這個尺寸相當於約 8 點字,每英吋 150 點。
- 自訂模型訓練:自訂範本模型的最大訓練頁面數為 500 頁,自訂神經模型為 50,000 頁。
- 自訂擷取模型訓練:模板模型的訓練資料總大小為 50 MB,神經模型為 1 GB。
- 自訂分類模型訓練:訓練資料總大小為 1 GB,最多可達 10,000 頁。 2024-11-30(通用時間)訓練資料總大小為 2 GB,最大可達 10,000 頁。
- Office 檔案類型(DOCX、XLSX、PPTX):字串長度上限為 800 萬字元。
- 支援的檔案格式:JPEG、PNG、PDF 及 TIFF。
- 支援的 PDF 與 TIFF,最多可處理 2,000 頁。 對於免費訂閱者,僅處理前兩頁。
- 支援的檔案大小必須小於 50 MB,尺寸至少為 50 x 50 像素,最多為 10,000 x 10,000 像素。
發票模型資料擷取
看看如何從發票中提取資料,包括客戶資訊、供應商細節及項目。 你需要以下資源:
在 Document Intelligence Studio 首頁,選擇 發票。
你可以分析發票範本或上傳自己的檔案。
選擇 「執行分析 」按鈕,必要時設定 分析選項 :
文件智能範例標籤工具
請導航至文件智慧範例工具。
在範例工具首頁,選擇 「使用預建模型以取得資料 圖塊」。
從下拉選單選擇 表單類型 以供分析。
請從以下選項中選擇你想分析的檔案網址:
在 來源 欄位,從下拉選單選擇 URL ,貼上所選 URL,然後選擇 擷取 按鈕。
在 文件智慧服務端點 欄位,貼上你透過文件智慧訂閱取得的端點。
在 關鍵 欄位,貼上你從文件智慧資源取得的鑰匙。
選擇 執行分析。 文件智慧範例標籤工具會呼叫 Analyze Prebuilt API,並分析文件。
查看結果——查看擷取的鍵值對、行項目、被選取的文字,以及偵測到的資料表。
註
範例標籤工具不支援 BMP 檔案格式。 這是工具本身的限制,而非文件情報服務。
支援語言與地點
欲了解完整支援語言清單, 請參閱 我們的 預設模型語言支援 頁面。
欄位擷取
關於支援的文件擷取欄位,請參考我們 GitHub 範例庫中的
頁面。invoice 模型架構 擷取的發票索引鍵-值組和明細項目位於 JSON 輸出的
documentResults區段中。
鍵值對
預建發票模型支援選擇性傳回索引鍵-值組。 預設情況下,鍵值對的回傳是被禁用的。 索引鍵-值組是發票中的特定範圍,用來識別標籤或索引鍵及其相關回應或值。 在發票中,這些組可能是標籤,以及使用者為該欄位或電話號碼輸入的值。 AI 模型經過訓練,能根據各種文件類型、格式與結構,擷取可辨識的鍵與值。
當模型偵測到有鍵存在但沒有相關值,或處理可選欄位時,鍵也可能獨立存在。 例如,表單中某些中間名欄位可能會留空。 索引鍵-值組一律是文件中包含的文字範圍。 對於以不同方式描述相同值的文件,例如 customer/user,相關聯的索引鍵會是 customer 或 user (根據內容)。
JSON 輸出
JSON 輸出包含三個部分:
-
"readResults"節點包含所有已識別的文字與選取標記。 文字先依頁面排列,再依行數排列,最後依單字排列。 -
"pageResults"節點包含擷取的資料表和儲存格,以及其周框方塊、信賴度,以及對 readResults 中行和字的參考。 -
"documentResults"node 包含模型已識別的發票專屬值與行項目。 這裡可以找到發票中的所有欄位,例如發票識別碼、收貨方、帳單收件方、客戶、總計、明細項目等等。
遷徙指南
- 請遵循我們的 文件智慧 v3.1 遷移指南 ,了解如何在您的應用程式與工作流程中使用 v3.0 版本。
::: moniker-end
下一步
試著用 文件智慧工作室處理你自己的表單和文件。
完成 一份文件智慧快速入門 ,並開始用你選擇的開發語言創建文件處理應用程式。
試著用 文件智慧範例標籤工具處理你自己的表單和文件。
完成 一份文件智慧快速入門 ,並開始用你選擇的開發語言創建文件處理應用程式。