適用於:SQL Server
Azure Data Factory 中的 SSIS Integration Runtime
小提示
Microsoft Fabric Data Warehouse 是一個企業規模的關聯式倉庫,建立在資料湖基礎上,具備未來準備架構、內建 AI 及新功能。 如果你是資料倉儲新手,建議先從Fabric Data Warehouse開始。 現有的 專用 SQL 工作負載可升級至 Fabric,以取得資料科學、即時分析與報告等多項新功能。
Azure Synapse Analytics 工作可讓 SSIS 套件將表格式資料從檔案系統或 Azure Blob 儲存體複製到 Azure Synapse Analytics 專用 SQL 集區。 該工作會利用 PolyBase 來改善效能,如 Azure Synapse Analytics 載入模式及策略一文所述。 目前支援的來源資料檔案格式為使用 UTF8 編碼的分隔文字。 從檔案系統複製時,資料會先上傳到 Azure Blob 儲存體暫存,然後再上傳到專用 SQL 集區。 因此,會需要 Azure Blob 儲存體帳戶。
注意
不支援具有 資料湖 Gen2 服務類型的 Azure 儲存體連線管理員。
若要針對暫存或來源使用 Azure Data Lake Gen2,您可透過具有 Azure Blob 儲存體類型的 Azure 儲存體連線管理員進行連線。
Azure Synapse Analytics 任務 是 適用於 Azure 的 SQL Server Integration Services (SSIS) 功能套件 的一個元件。
若要新增 Azure Synapse Analytics 工作,請將其從 SSIS 工具箱拖放到設計工具畫布,然後按兩下或在其上按一下滑鼠右鍵,再按一下 [編輯],即可看到工作編輯器對話方塊。
在 [一般] 頁面上設定下列屬性。
SourceType 指定來源資料存放區的類型。 選取下列其中一種類型:
- 檔案系統: 來源資料所在的本機檔案系統。
- BlobStorage: 來源資料所在的 Azure Blob 儲存體。
以下是每個來源類型的屬性。
檔案系統
| 欄位 | 描述 |
|---|---|
| 本地目錄 | 指定包含要上傳之資料檔案的本機目錄。 |
| 遞迴地 | 指定是否要以遞迴方式搜尋子目錄。 |
| 檔案名稱 | 指定名稱篩選,以選取具有特定名稱模式的檔案。 舉例來說,MySheet*.xsl* 會包含 MySheet001.xsl 及 MySheetABC.xslx 這類的檔案。 |
| RowDelimiter | 指定標示各資料列結尾的字元。 |
| 欄位分隔符 | 指定一個或多個字元來標示每個欄位的結尾。 舉例來說:| (管線符號)、\t (製表符)、' (單引號)、" (雙引號) 和 0x5c (反斜線)。 |
| IsFirstRowHeader | 指定每個資料檔案中的第一個資料列是否包含資料行名稱,而非實際資料。 |
| AzureStorageConnection | 指定 Azure 儲存體連線管理員。 |
| BlobContainer | 指定將本機資料上傳並透過 PolyBase 轉送到 Azure Synapse Analytics 專用 SQL 集區的 Blob 容器名稱。 如果容器不存在,系統將會建立新容器。 |
| BlobDirectory | 指定要透過 PolyBase 將本機資料上傳及轉送到 Azure Synapse Analytics 專用 SQL 集區的目的 Blob 目錄 (虛擬階層式結構)。 |
| RetainFiles | 指定是否要保留上傳到 Azure 儲存體的檔案。 |
| 壓縮類型 | 指定在將檔案上傳到 Azure 儲存體時要使用的壓縮格式。 本機來源不會受到影響。 |
| 壓縮等級 | 指定要用於壓縮格式的壓縮層級。 |
| SqlPoolConnection | 指定適用於 Azure Synapse Analytics 專用 SQL 集區的 ADO.NET 連接管理員。 |
| TableName | 指定目的資料表的名稱。 選擇現有的資料表名稱,或選擇 <新增資料表...> 建立新的資料表。 |
| TableDistribution | 指定新資料表的發佈方法。 如果為 TableName指定了新的資料表名稱即適用。 |
| HashColumnName | 指定用於雜湊表分配的資料行。 如果為 TableDistribution 指定了 HASH即適用。 |
BlobStorage(Blob 儲存服務)
| 欄位 | 描述 |
|---|---|
| AzureStorageConnection | 指定 Azure 儲存體連線管理員。 |
| BlobContainer | 指定來源資料所在的 Blob 容器名稱。 |
| BlobDirectory | 指定來源資料所在的 Blob 目錄 (虛擬階層式結構)。 |
| RowDelimiter | 指定標示各資料列結尾的字元。 |
| 欄位分隔符 | 指定一個或多個字元,以標示每個資料行的結尾。 舉例來說:| (縱線字元)、\t (定位字元)、' (單引號)、" (雙引號) 和 0x5c (反斜線)。 |
| 壓縮類型 | 指定來源資料使用的壓縮格式。 |
| SqlPoolConnection | 指定 Azure Synapse Analytics 專用 SQL 集區的 ADO.NET 連線管理員。 |
| TableName | 指定目的資料表的名稱。 選擇現有的資料表名稱,或選擇 <新增資料表...> 建立新的資料表。 |
| TableDistribution | 指定新資料表的發佈方法。 如果為 TableName指定了新的資料表名稱即適用。 |
| HashColumnName | 指定用於雜湊表分配的資料行。 如果為 TableDistribution 指定了 HASH即適用。 |
根據您是複製到新資料表還是現有資料表,您會看到不同的 [對應] 頁面。 如果是前者,請設定要對應哪些來源資料行,及其在要建立的目的資料表中對應名稱為何。 如果是後者,請設定來源與目的欄位之間的對應關係。
在 [資料行] 頁面上,為各來源資料行設定資料類型屬性。
[T-SQL] 頁面會顯示用於將資料從 Azure Blob 儲存體載入至專用 SQL 集區的 T-SQL。 T-SQL 從其他頁面上的組態自動產生,會在工作執行過程中執行。 您也可以按一下 [編輯] 按鈕以手動編輯產生的 T-SQL,使其符合您的特定需求。 您可以之後按一下 [重設] 按鈕,恢復成自動產生的設定。