Iceberg 格式於 Azure 數據工廠 和 Azure Synapse 分析中

適用於: Azure Data Factory Azure Synapse Analytics

提示

Data Factory in Microsoft Fabric 是下一代的 Azure Data Factory,擁有更簡單的架構、內建 AI 及新功能。 如果你是資料整合新手,建議先從 Fabric Data Factory 開始。 現有的 ADF 工作負載可升級至 Fabric,以存取資料科學、即時分析與報告等新能力。

當您想要 將數據寫入 Iceberg 格式時,請遵循這篇文章。

下列連接器支援 Iceberg 格式:

你可以在 複製活動 使用冰山資料集。

資料集屬性

如需可用來定義資料集的區段和屬性完整清單,請參閱資料集一文。 本節提供 Iceberg 格式數據集所支持的屬性清單。

屬性 描述 必要
型別 數據集的 type 屬性必須設定為 Iceberg。 Yes
位置 檔案的位置設定。 每個檔案型連接器都包含專屬的位置類型,並支援 location 下的屬性。 Yes

以下是 Azure Data Lake Storage Gen2 上的 Iceberg 資料集範例:

{
    "name": "IcebergDataset",
    "properties": {
        "type": "Iceberg",
        "linkedServiceName": {
            "referenceName": "<Azure Data Lake Storage Gen2 linked service name>",
            "type": "LinkedServiceReference"
        },
        "schema": [ < physical schema, optional, auto retrieved during authoring >
        ],
        "typeProperties": {
            "location": {
                "type": "AzureBlobFSLocation",
                "fileSystem": "filesystemname",
                "folderPath": "folder/subfolder",
            }
        }
    }
}

複製活動屬性

如需可用來定義活動的區段和屬性完整清單,請參閱管線一文。 本區段提供 Iceberg 接收器支援的屬性清單。

冰山作為水槽

複製活動的 sink 區段支援下列屬性。

屬性 描述 必要
型別 複製活動來源的 type 屬性必須設定為 IcebergSink。 Yes
格式設定 屬性群組。 請參閱下方的 Iceberg 寫入設定表。 否
儲存設定 一組屬性用於決定如何將資料寫入資料存放區。 每個以檔案為基礎的連接器在 storeSettings 底下皆具有自身的支援寫入設定。 否

在 之下支援的 formatSettings:

屬性 描述 必要
型別 formatSettings 的類型必須設定為 IcebergWriteSettings。 Yes

以下是一些與分隔符號文字格式相關的常見連接器和格式: