對應資料流中的樞紐轉換

適用於: Azure Data Factory Azure Synapse Analytics

資料流可同時在 Azure Data Factory 資料管線和 Azure Synapse Analytics 資料管線中使用。 本文章適用於映射資料流。 如果您不熟悉資料轉換,請參閱入門文章使用對應資料流程轉換資料。

提示

關於 Dataflow Gen2 中的對等轉換 (樞紐資料行),請參閱用於對應資料流程的 Dataflow Gen2 使用者指南。

使用樞紐轉換,從單一資料行的唯一資料列值建立多個資料行。 樞紐是一種彙總轉換,您可以選取依據資料行分組,並使用彙總函式來產生樞紐資料行。

組態

樞紐轉換需要三個不同的輸入:依據資料行分組、樞紐索引鍵,以及如何產生已樞紐轉換的資料行

分組依據

依選項分組

請選取要用於彙總樞紐資料行的資料行。 輸出資料會將所有具有相同組別值的列分組成一列。 樞軸欄位中的聚合是針對每個群組進行的。

本節為選擇性。 若未選擇欄位分組,則整個資料流會被彙總,且僅輸出一列資料。

樞紐索引鍵

樞紐索引鍵

樞紐索引鍵是其資料列值經樞紐處理成新資料行的資料行。 預設情況下,樞軸轉換會為每個獨特列值建立一欄。

在標示為值 的區段中,您可以輸入要樞紐處理的特定資料列值。 只有本區段輸入的列值會被樞軸化。 啟用 Null 值 會為該欄位的 null 值建立一個樞紐欄位。

樞紐處理過的資料行

樞紐處理過的資料行

針對每個成為資料行的唯一樞紐索引鍵值,為每個群組產生彙總的資料列值。 您可以為每個樞紐索引鍵建立多個資料行。 每個樞紐資料行都必須包含至少一個聚合函數。

資料行名稱模式:選取如何設定每個樞紐資料行的資料行名稱格式。 輸出的欄位名稱是樞軸鍵值、欄位前綴,以及可選的前綴、後綴、中間字元的組合。

資料行排列:如果您針對每個樞紐索引鍵產生一個以上的樞紐資料行,請選擇您希望排列這些資料行的方式。

資料行前綴:如果您針對每個樞紐索引鍵產生多個樞紐資料行,請為每個資料行輸入一個資料行前綴。 如果您只有一個已樞紐處理的資料行,這項設定為選用。

說明圖形

說明圖示展示了不同的樞軸元件如何相互作用

Pivot 幫助圖形

樞紐中繼資料

若樞軸鍵配置中未指定值,樞軸欄位會在執行時動態產生。 樞軸欄位的數量等於唯一樞紐鍵值的數量乘以樞軸欄位的數量。 由於這是一個變動的數字,因此 UX 不會在檢查索引標籤中顯示資料行中繼資料,且將不會有任何資料行傳播。 若要轉換這些資料行,請使用對應資料流的資料行模式功能。

若設定了特定的樞紐鍵值,樞紐欄位會出現在元資料中。 資料行名稱可供您在檢查和接收對應中使用。

從漂移的資料行產生中繼資料

樞紐會根據資料列值動態產生新的資料行名稱。 您可以將這些新欄位新增至中繼資料中,以便日後在資料流中參考。 若要進行上述動作,請在資料預覽中使用對應漂移的快速動作。

透視欄

接收已樞紐處理的資料行

雖然已樞紐處理的資料行是動態的,但仍可寫入到您的目標資料存放區。 在接收設定中啟用允許結構描述漂移。 這讓你可以寫出不包含在元資料中的欄位。 您在資料行中繼資料中不會看到新的動態名稱,但結構描述漂移選項會讓您成功匯入資料。

重新加入原始欄位

樞紐轉換只會投射分組依據和已樞紐處理的資料行。 如果您想要讓輸出資料包含其他輸入資料行,請使用自我聯結模式。

資料流程指令碼

語法

<incomingStreamName>
    pivot(groupBy(Tm),
        pivotBy(<pivotKeyColumn, [<specifiedColumnName1>,...,<specifiedColumnNameN>]),
        <pivotColumnPrefix> = <pivotedColumnValue>,
        columnNaming: '< prefix >< $N | $V ><middle >< $N | $V >< suffix >',
        lateral: { 'true' | 'false'}
    ) ~> <pivotTransformationName

範例

[設定] 區段中所顯示的畫面具有下列資料流程指令碼:

BasketballPlayerStats pivot(groupBy(Tm),
    pivotBy(Pos),
    {} = count(),
    columnNaming: '$V$N count',
    lateral: true) ~> PivotExample

嘗試取消樞紐轉換,將資料行值轉換為資料列值。