遷移規劃:從 Teradata 轉Fabric Data Warehouse

適用於:Microsoft Fabric 中的✅ 資料庫

將企業級 Teradata 資產遷移到 Fabric Data Warehouse 不僅僅是架構與資料傳輸。 規劃 SQL 與 BTEQ 程式碼、載入流程、安全、報告、營運及效能。

本文將工作分為五個階段。 將這些階段作為供每個移轉波次使用的可重複操作手冊。 關於推薦的實作方式,請參見 Teradata 的遷移方法。 關於程式碼修復,請參見 Translate Teradata SQL for Fabric Data Warehouse。

Important

在每次遷移波之前,確認目前的Fabric Data Warehouse限制和 T-SQL 表面積。 為每個阻礙性差異指派負責人和修正計畫。

對大多數工作負載使用選擇性現代化:

  • 保留經過驗證的商業模式與邏輯。
  • 使用 移轉小幫手 來翻譯並部署支援的元資料。
  • 以 Fabric 原生模式取代 Teradata 專屬的 SQL、工具與操作。
  • 僅重新設計那些因不受支援的相依性或現有架構上的問題而受阻的工作負載。

依業務領域、資料集市或工作負載叢集分波遷移。 避免一次大規模遷徙。

評估與評定

請一起評估這些工作流程,避免遺漏任何相依性:

工作流 Assess
設計與性能 資料模型、資料量、成長、偏移、資料表寬度、並行性、執行時與服務目標
ETL 與載入 FastLoad、MultiLoad、Teradata 平行傳輸器、BTEQ 匯入/匯出、排程、重啟行為及增量載入
安全與行動 使用者、角色、權限、服務帳號、稽核、復原、監控與支援所有權
視覺化與報告 報告、語意模型、應用程式、匯出、刷新排程與連線依賴
SQL 相容性 表格、視圖、巨集、程序、函式、資料型別、 QUALIFY揮發性資料表, PERIOD以及 BTEQ 控制流程
遷移工具 元資料擷取、移轉小幫手 準備、資料移動、原始碼控制與部署自動化
超越遷徙 切換、回滾、優化、培訓、退役,以及供後續波次重複運用的做法

定義業務成果、範圍、擁有者、成功指標及回滾期望。 建立物件清單、相依關係圖、工作負載基線、相容性登錄表及分波計畫。

規劃與設計

將評估轉化為可執行的設計:

  1. 確認 Warehouse 為以 SQL 為中心的關聯式分析目標平台。
  2. 定義開發、測試與生產工作區、容量、命名及所有權。
  3. 將 Teradata 物件與資料型態映射到 Fabric 目標。 記錄無支持項目及核准的替代方案。 使用 移轉小幫手 進行元資料翻譯。
  4. 分別設計歷史資料流動與增量資料流動。
  5. 以 Microsoft Entra ID、工作區角色、項目層級權限及 Warehouse SQL 權限為核心,重新設計存取控制。
  6. 定義部署、驗證、切換與回滾標準。

目標設計中應採用量度模型、批次導向載入、模組化 ELT,並透過 OneLake 進行管理重用。

Migrate

依照以下順序執行每一波:

  1. 配置目標工作空間、識別碼、連線及部署路徑。
  2. 將擷取的 Teradata SQL 檔案上傳至 移轉小幫手,轉譯元資料,並修正需要關注的物件。
  3. 複製一個具代表性的資料集,並驗證吞吐量、映射、錯誤及重啟行為。
  4. 完成歷史載入,並在需要時建立增量同步。
  5. 重建安全與營運流程。
  6. 驗證資料、SQL 行為、報告、應用程式及代表性效能。
  7. 通過驗收標準後重新路由連接並切斷。

不要只用物件建立成功作為完成的信號。 只有當資料、行為、安全、營運及下游消費都通過其接受標準時,波才算完整。

監視及管理

依工作負載的風險概況所要求的期間,讓來源端與目標端並行運作。

  • 比較不同環境的資料新鮮度、資料列數、業務彙總及報告結果。
  • 監控載入持續時間、查詢持續時間、失敗次數、重試次數、容量消耗、作用中工作階段,以及使用者回報的問題。
  • 檢視存取權分配、特權身份、倉庫權限及安全測試結果。
  • 將已翻譯的程式碼、部署資產、映射決策、測試證據和例外都放在原始碼控制中。
  • 依工作負載與驗收閘追蹤遷移準備度,而非僅依遷移物件數量。
  • 記錄反覆出現的翻譯與載入問題,作為後續波次的可重複使用指引。
  • 在生產切換前建立升級、恢復、回滾及超照護程序。

治理涵蓋血統、所有權、分類、保留、稽核及營運問責。 請在遷移期間套用這些控制措施,而不是在最終切換完成後才套用。

優化與現代化

在建立正確性與穩定性後,移除暫時的相容模式,改用 Fabric 原生功能。

  • 將 SQL 的字面翻譯重構成模組化的 T-SQL。
  • 簡化深層巢狀的視圖與單體式程序作業。
  • 將高吞吐量資料擷取標準化為採用高效且可重新啟動的檔案式模式。
  • 使用 Fabric Data Warehouse 效能指引和具代表性的並行測試加以調校。
  • 在架構適合的地方使用受控的 OneLake 存取,減少不必要的資料複製。
  • 整合 Data Factory、Power BI、筆記型電腦及其他 Fabric 工作負載,以降低重複或操作複雜度。
  • 工作負載行為穩定後,檢視容量、安全性、可靠性與成本。
  • 將完成的波段轉換成下一個領域可重複使用的範本。

遷移波接受清單

切換前,請確認:

  • 此波次的物件清單與相依性對應圖已完成。
  • 造成阻礙的 T-SQL 限制已有核准的補救措施。
  • 架構與程式碼可在每個目標環境中重複部署。
  • 歷史與增量資料路徑通過規模與復原測試。
  • 資料對帳與業務驗證符合約定的門檻。
  • 安全性會以具代表性的身分重新建立並加以驗證。
  • 報告、語意模型、應用程式及營運工作都能通過測試。
  • 效能與並行性符合工作負載目標。
  • 監控、支援所有權、回滾及超照護計畫均已啟動。
  • 業務與技術負責人核准切換作業。