Różnice między usługami Azure Data Factory i Fabric Data Factory

Fabric Data Factory to kolejna generacja Azure Data Factory. Dzięki wykorzystaniu usługi OneLake jako ujednoliconej warstwy magazynowania rozwiązanie Fabric Data Factory zmniejsza złożoność infrastruktury i potrzebę przemieszczania danych. Potoki mogą pracować bezpośrednio z danymi na żywo za pomocą skrótów usługi OneLake i współużytkowania między dzierżawami.

W tym artykule porównaliśmy podstawowe funkcje, działania, łączniki i składniki infrastruktury obu usług. Aby zaplanować migrację, zobacz przewodnik planowania migracji.

Porównaj funkcje obok siebie

Poniżej przedstawiono sposób stosu podstawowych funkcji między usługą Azure Data Factory i usługą Fabric Data Factory. Tabela zawiera informacje o tym, co się zmieniło, co nowego i co pozostaje takie same.

Azure Data Factory Fabric Data Factory Co się różni
rurociąg rurociąg Lepsza integracja: Potoki w Fabric działają płynnie z domami nad jeziorem, magazynami i innymi elementami Fabric od razu po wyjęciu z pudełka. Potoki sieci szkieletowej obejmują więcej działań opartych na modelu SaaS i różnią się definicjami JSON. Aby uzyskać więcej informacji, zobacz porównanie funkcji potoku .
Mapowanie przepływu danych Przepływ danych Gen2 Łatwiejsze w użyciu: przepływ danych Gen2 zapewnia prostsze środowisko tworzenia przekształceń. Cały czas dodajemy więcej funkcji przepływu danych mapowania do usługi Gen2.
Działania Działania Więcej działań wkrótce: Pracujemy nad przeniesieniem wszystkich Twoich ulubionych działań z usługi ADF do Fabric. Ponadto otrzymujesz nowe funkcje, takie jak działanie Office 365 Outlook, które nie jest dostępne w ADF. Zobacz nasze porównanie działań , aby uzyskać szczegółowe informacje.
Zestaw danych Tylko połączenia Prostsze podejście: Nie ma bardziej złożonych konfiguracji zestawów danych. W usłudze Fabric Data Factory używasz połączeń, aby połączyć się ze źródłami danych i rozpocząć pracę. Fabric eliminuje zestawy danych, definiując właściwości danych bezpośrednio wewnątrz działań.
Połączona usługa Połączenia Bardziej intuicyjne: Połączenia działają jak połączone usługi, ale są łatwiejsze do skonfigurowania i zarządzania.
Wyzwalacze Wyzwalacze zdarzeń harmonogramu i plików Wbudowane planowanie: użyj harmonogramu Fabric i zdarzeń Reflex, aby automatycznie uruchamiać potoki. Wyzwalacze zdarzeń plików działają natywnie w Fabric bez dodatkowej konfiguracji. Fabric integruje wyzwalacze ze swoim frameworkiem Activator, w przeciwieństwie do samodzielnych wyzwalaczy ADF.
Publikowanie Zapisywanie i uruchamianie Brak kroku publikowania: w usłudze Fabric całkowicie pomiń krok publikowania. Wystarczy wybrać pozycję Zapisz, aby zapisać pracę, lub wybrać pozycję Uruchom, aby zapisać i natychmiast wykonać potok.
Autoresolve i Środowisko Uruchomieniowe Azure Integration Nie jest wymagany Uproszczona architektura: nie trzeba zarządzać środowiskami Integration Runtime. "Fabric zarządza obliczeniami za ciebie."
** Lokalne składnie uruchomieniowe dla integracji Lokalna brama danych Ten sam dostęp lokalny: Połącz się z danymi lokalnie za pomocą znanej bramki danych lokalnej. Dowiedz się więcej w naszym przewodniku po dostępie do danych lokalnych.
Środowiska uruchomieniowe integracji Azure-SSIS Do ustalenia Przyszłe możliwości w Fabric: nadal pracujemy nad projektem integracji SSIS w Fabric.
Zarządzane sieci wirtualne i prywatne punkty końcowe Do ustalenia. Przyszłe możliwości w Fabric: nadal pracujemy nad integracją z zarządzanymi sieciami wirtualnymi i prywatnymi punktami końcowymi w ramach Fabric.
Język wyrażeń Język wyrażeń Te same wyrażenia: istniejące wyrażenia bezpośrednio przenoszą wiedzę. Składnia jest prawie identyczna.
Typy uwierzytelniania Rodzaje uwierzytelniania Więcej opcji: Wszystkie popularne metody uwierzytelniania usługi ADF działają w Fabric, a także dodaliśmy nowe typy uwierzytelniania.
ciągła integracja/ciągłe wdrażanie ciągła integracja/ciągłe wdrażanie Ulepszone możliwości poza usługą ADF obejmują łatwe wybieranie elementów, podwyższanie poziomu poszczególnych elementów, włączanie repozytorium Git i wbudowane opcje ciągłej integracji/ciągłego wdrażania SaaS.
Eksportowanie/importowanie szablonu ARM Zapisz jako Szybkie duplikowanie: W Fabric użyj polecenia "Zapisz jako", aby szybko duplikować przepływy na potrzeby rozwoju lub testowania.
Monitorowanie Centrum monitorowania i historia uruchamiania Zaawansowane monitorowanie: Centrum monitorowania oferuje nowoczesne środowisko ze szczegółowymi informacjami między obszarami roboczymi i lepszymi możliwościami zagłębiania się w szczegóły.
Debugowanie Tryb interaktywny Uproszczone debugowanie: Fabric eliminuje tryb debugowania ADF. Zawsze jesteś w trybie interaktywnym.
Przechwytywanie zmian danych (CDC) Zadania kopiowania Przyrostowe przenoszenie danych: Fabric obsługuje przyrostowe przenoszenie danych za pomocą zadań kopiowania zamiast artefaktów CDC.
Azure Synapse Link Odwzorowywanie Replikacja danych: sieć szkieletowa zastępuje usługę Azure Synapse Link funkcjami dublowania na potrzeby replikacji danych.
Wykonywanie działania potoku Uruchom działanie potoku Wywołanie międzyplatformowe: Fabric rozszerza działanie Execute Pipeline w usłudze ADF o obsługę wywołań międzyplatformowych.

Porównanie funkcji potoku

Kategoria Potoki ADF Potoki sieci szkieletowej
Typ usługi Usługa PaaS integracji danych Usługa SaaS integracji danych
Środowisko do tworzenia treści portal Azure (ADF Studio) Fabric / Power BI workspace (zunifikowane UX z domami nad jeziorem, magazynami itd.)
Orkiestracja potoku Potoki w pełni funkcjonalne z działaniami, wyzwalaczami, parametrami Ten sam model orkiestracji, przemyślany na nowo dla interfejsu użytkownika Fabric.
Przenoszenie danych Kopiowanie danych, mapowanie przepływów danych, obsługa lokalnego IR, zarządzana sieć wirtualna działanie kopiowania, Dataflows Gen2, wbudowana łączność z usługą OneLake i elementami usługi Fabric, skróty OneLake umożliwiające dostęp na żywo do danych bez kopiowania, lokalna brama danych, brama sieci wirtualnej
Środowisko obliczeniowe/środowisko IR Lokalnie hostowane, SSIS i Azure IR (do przenoszenia i przekształcania) Połączenia w chmurze, lokalne i brama sieci wirtualnej
Przepływy danych Azure Blob, magazyn Data Lake, SQL, ponad 100 konektorów Te same łączniki i natywna integracja OneLake, ściślejsza integracja obszaru roboczego Fabric
Monitorowanie potoki i przepływy danych w ADF Studio obejmujące uruchomienia, wyzwalacze i alerty Centrum monitorowania i monitorowanie obszaru roboczego z ujednoliconymi widokami obejmującymi potoki, przepływy danych, notesy, bazy danych itd.
Wyzwalacze Harmonogramy, okna przesuwne, wyzwalacze oparte na zdarzeniach Harmonogramy, wyzwalacze zdarzeń, wyzwalacze okna wirowania jako harmonogramy interwałów. Potoki korzystające z danych na żywo za pośrednictwem skrótów usługi OneLake i współużytkowania między dzierżawami bezproblemowo współpracują ze wszystkimi typami wyzwalaczy Fabric.
ciągła integracja/ciągłe wdrażanie Szablony usługi ARM i integracja z usługą Azure DevOps lub repozytorium GitHub Wbudowane potoki wdrażania w Fabric; promocja na poziomie obszaru roboczego (Deweloperskie → Test → Produkcja) i integracja zewnętrznego repozytorium
Zabezpieczenia Tożsamości zarządzane, integracja z Key Vault, prywatne punkty końcowe Ten sam model zabezpieczeń plus RBAC w obszarze roboczym Fabric; Integracja zabezpieczeń z OneLake
Udostępnianie danych i nadzór N/A Udostępnianie danych między dzierżawami za pośrednictwem skrótów OneLake umożliwia zarządzany dostęp do danych na żywo przez granice organizacji bez duplikowania
Pricing Płatność zgodnie z rzeczywistym poziomem wykorzystania na platformie Azure (na podstawie uruchamiania działań, przenoszenia danych i mocy obliczeniowej) Jednostka SKU oparta na pojemności (Fabric F SKU) bez opłat za działania zewnętrzne lub aktywności związane z potokami, jedynie za uruchomienia działań i przenoszenie danych w potokach.

Porównanie działań

Dzięki Data Factory nadal utrzymujemy wysoki stopień ciągłości z Data Factory. Około 90% aktywności dostępnych w ADF jest już dostępnych w ramach Data Factory. Oto przegląd działań i ich dostępności zarówno w ADF, jak i Data Factory:

Activity ADF Fabryka danych
ADX/KQL Y Y
Dołącz zmienną Y Y
Niestandardowe (usługa Azure Batch w sieci szkieletowej) Y Y
Azure Databricks Działanie notebooka • Uruchomienie JAR-a • Działanie Pythona • Proces zadania Działanie usługi Azure Databricks
Azure Machine Learning Y Y
Wykonywanie wsadowe w usłudze Azure Machine Learning Deprecated N/A
Zasób aktualizacji usługi Azure Machine Learning Deprecated N/A
Kopiuj Kopiowanie danych operacja kopiowania
Przepływ danych Gen2 N/A Y
Usuń Y Y
Uruchomienie/Wywołanie Pipeline'u Wykonywanie pipeline Wywołaj potok
Notatniki Fabric N/A Y
Błąd Y Y
Filter Y Y
Dla każdego Y Y
Functions Funkcja platformy Azure Działanie funkcji
Pobieranie metadanych Y Y
HDInsight Aktywność Hive • Aktywność Pig • Aktywność MapReduce • Aktywność Spark • Aktywność przesyłania strumieniowego Działanie usługi HDInsight
Instrukcja warunkowa if Y Y
Szukaj Y Y
Mapowanie przepływu danych Y Przepływ danych Gen2
Office 365 Outlook N/A Y
Power Query (tylko usługa ADF — uzdatnianie przepływu danych) Deprecated N/A
Skrypt Y Y
Odświeżenie modelu semantycznego N/A Y
Ustaw zmienną Y Y
Sproc Y Y
SSIS Y N/A
procedura składowana Y Y
Przełącznik Y Y
Działania Synapse Notebook i SJD Y N/A
Zespoły N/A Y
Aż do Y Y
Validation Y Pobieranie metadanych i konstrukcja if
Wait Y Y
sieć Web Y Y
Webhook Y Y
Zarządzanie przepływem danych Y Przepływ danych Gen2

Nowe działania w usłudze Fabric Data Factory

Oprócz utrzymania ciągłości aktywności, Fabric Data Factory wprowadza nowe aktywności, które zaspokoją Twoje bogatsze potrzeby orkiestracyjne. Te nowe działania to:

  1. Outlook: dostępna w usłudze Fabric Data Factory w celu ułatwienia integracji z usługami Outlook.
  2. Zespoły: dostępne w usłudze Fabric Data Factory w celu umożliwienia orkiestracji działań usługi Microsoft Teams.
  3. Odświeżanie modelu semantycznego: dostępne w usłudze Fabric Data Factory, aby zwiększyć możliwości odświeżania modelu semantycznego usługi Power BI.
  4. Dataflow Gen2: dostępna w usłudze Fabric Data Factory w celu umożliwienia orkiestracji danych dzięki zaawansowanym funkcjom przepływu danych.

Aby uzyskać listę wszystkich dostępnych działań usługi Fabric Data Factory, zobacz Omówienie działania.

Porównanie łączników

Porównanie wszystkich łączników i ich dostępności w usługach Azure Data Factory i Fabric Data Factory można znaleźć w artykule Porównanie łączników.

Własne środowisko Integration Runtime (SHIR) a lokalna brama danych (OPDG)

Uwaga / Notatka

Usługi wspierane przez SHIR i OPDG są różne:

  • Lokalne środowisko Integration Runtime: Obsługuje Data Factory, Azure Synapse Analytics, Azure Machine Learning studio oraz Azure Purview.
  • Brama danych lokalna: Obsługuje Power BI, Power Apps, Power Automate, Azure Analysis Services, Logic Apps, Fabric dataflow Gen2, Fabric pipeline, Fabric copy job oraz Fabric mirroring.
Kategoria Samodzielnie hostowane środowisko uruchomieniowe integracji (Self-hosted Integration Runtime, SHIR) Lokalna brama danych (OPDG)
Obsługiwane usługi — Azure Data Factory
— Azure Machine Learning Studio
— Azure Synapse Analytics
— Azure Purview
— Power BI
— Power Apps
— Power Automate
— Azure Analysis Services
- Aplikacje logiczne
- Przepływ danych Fabric Gen2
— Potok sieci szkieletowej
- Zadanie kopiowania sieci szkieletowej
- Dublowanie Fabric w sieci
Instalacja i rejestracja - Zarejestrowane z użyciem klucza
- Działa w trybie usługi
— Zarejestrowane przy użyciu konta Microsoft Entra ID
- Obsługuje tryb użytkownika
Platform -Windows
— Obsługiwany obraz kontenera
— Tylko system Windows
— Brak obsługi kontenerów
Obsługa serwera proxy — Obsługa zarówno systemu, jak i niestandardowego serwera proxy - Obsługa niestandardowego serwera proxy
Powiązanie regionu Poprawiono z przypisaniem do regionu usługi Data Factory
— Nie można zmienić regionu domyślnego
- Region można zmienić
Przekaźnik niestandardowy - Nie obsługiwane - Obsługiwane; klienci mogą przywieźć swój własny przekaźnik
Udostępnianie między usługami — Udostępnione maksymalnie 120 fabrykom danych
— Nie można udostępniać ich w obszarach roboczych usług ADF, Synapse, Purview lub Synapse
— Dostępne dla wszystkich obsługiwanych usług w ramach klienta
Wysoka dostępność (HA) - Do 8 węzłów (domyślnie 4) - Maksymalnie 10 węzłów
Recovery — Wymaga ponownej instalacji — Obsługiwany klucz odzyskiwania
Równoważenie obciążenia - Równoważenie obciążenia na poziomie zadania na podstawie dostępnej liczby pracowników (procesor i pamięć) - Równoważenie obciążenia na poziomie zapytania
- Opcje działania okrężnego lub dystrybucji losowej
Magazyn poświadczeń - Przechowywane lokalnie w węzłach SHIR
— Obsługiwana usługa Azure Key Vault
Centralnie przechowywane w usłudze chmury Gateway
— Brak integracji z usługą Key Vault
Automatyczna aktualizacja - Obsługiwane - Nie obsługiwane
Rozszerzalność łącznika - Nie obsługiwane - Obsługiwane
Tworzenie interakcyjne - Obsługiwane - Obsługiwane
Usługa Private Link dla przepływu sterowania - Obsługiwane - Nie obsługiwane
Wersjonowanie - Dwie wersje miesięcznie; jedna dostarczana jako autoaktualizacja
— Obsługuje ostatnie 12 miesięcy wydań
- Jedna wersja miesięcznie
- Obsługuje ostatnie 6 wydań
Ograniczanie wydajności procesora i pamięci - Nie obsługiwane - Obsługiwane
Limity przepływności - Brak twardego limitu; zależne od przepustowości sieci Limity specyficzne dla usługi:
Power Apps/Power Automate/ Logic Apps:
- Zapisz: limit ładunku 2 MB
- Odczyt: limit żądań 2 MB, limit odpowiedzi skompresowanej 8 MB
- Limit adresów URL żądania GET: 2048 znaków
Power BI DirectQuery: limit odpowiedzi nieskompresowanej 16 MB

Zarządzana sieć wirtualna ADF a brama danych sieci wirtualnej Fabric

Zarządzana sieć wirtualna Azure Data Factory (ADF) oraz brama danych sieci wirtualnej (VNet) platformy Fabric umożliwiają bezpieczne łączenie ze źródłami danych bez udostępniania ich w publicznym Internecie. Chociaż obie opcje obsługują łączność prywatną dla obciążeń w chmurze, różnią się one sposobem ich konfigurowania, kto nimi zarządza i które usługi obsługują.

  • Zarządzana sieć wirtualna ADF
    Firma Microsoft jest właścicielem środowiska sieciowego i zarządza nim. Uzyskasz prostą konfigurację, ale nie możesz kontrolować ustawień sieci ani reguł zapory.

  • Fabric VNET data gateway Bramę wdrażasz we własnej wirtualnej sieci platformy Azure. Zapewnia to pełną kontrolę nad siecią, zaporą i skalowaniem. Decydujesz, jak brama łączy się z Twoimi zasobami i zarządzasz wszystkimi ustawieniami sieci.

Skorzystaj z poniższej tabeli, aby porównać główne różnice i wybrać opcję pasującą do potrzeb związanych z obciążeniem i zarządzaniem.

Kategoria Zarządzana sieć VNet usługi ADF Fabric VNet data gateway
Obsługiwane usługi Potoki usługi Azure Data Factory i Synapse. Przepływy danych Fabric Gen2, potoki danych Fabric, zadanie kopiowania Fabric, replikacja lustrzana Fabric, modele semantyczne Power BI oraz raporty stronicowane Power BI
Własność sieci wirtualnej Wirtualna sieć zarządzana przez Microsoft (klient nie kontroluje sieci). Zarządzana przez klienta sieć wirtualna (klient ma pełną kontrolę).
Prywatne punkty końcowe Automatycznie tworzone i zarządzane przez ADF dla obsługiwanych usług (Azure Storage, SQL DB itp.). Klienci konfigurują bramę sieci wirtualnej, aby łączyć obciążenia Fabric z zasobami wewnątrz swojej sieci wirtualnej.
Kontrolka sieci Ograniczone — klienci mogą zezwalać tylko na dodawanie środowiska Integration Runtime sieci wirtualnej do prywatnych punktów końcowych. Pełna kontrola — klient konfiguruje zaporę, reguły NSG i trasowanie w swojej sieci wirtualnej.
Instalacja/wdrożenie Nie jest wymagana instalacja; w pełni zarządzana przez firmę Microsoft wewnątrz ukrytej sieci wirtualnej. Wymaga wdrożenia bramki danych sieci wirtualnej w sieci wirtualnej klienta.
Wysoka dostępność Zarządzane przez Microsoft, automatycznie skalowane w wirtualnej sieci ADF. Przełącz na tryb zapasowy podczas włączania TTL. Obsługuje skalowanie i wysoką dostępność (klastry oparte na węzłach), ale działa w sieci wirtualnej zarządzanej przez klienta. Obsługuje do siedmiu węzłów.

Możliwości usługi Data Factory w usłudze Fabric

usługa Fabric Data Factory zawiera Copilot dla usługi Data Factory, która używa języka naturalnego do tworzenia potoków, przepływów danych i innych elementów usługi Data Factory oraz zarządzania nimi.

Integracja rodzimych domów nad jeziorem i magazynu

Jedną z największych zalet usługi Fabric Data Factory jest sposób łączenia się z platformami danych. Domy nad jeziorem i magazyny w Fabric działają zarówno jako źródła, jak i miejsca docelowe w Twoich pipeline'ach, co ułatwia budowanie zintegrowanych projektów danych. Potoki mogą również działać w tabelach typu lakehouse wspieranych przez skróty oneLake, co umożliwia przekształcanie i organizowanie danych ze źródeł zewnętrznych (w tym udziałów między dzierżawami) bez uprzedniego kopiowania ich do obszaru roboczego.

Zrzut ekranu pokazujący zakładkę źródłowy Lakehouse i magazyn.

Zrzut ekranu pokazujący kartę miejsca docelowego Lakehouse i Warehouse.

Powiadomienia e-mail z Office 365

Działanie Office 365 Outlook wysyła dostosowane powiadomienia e-mail dotyczące uruchomień potoku, stanu działania i wyników.

Zrzut ekranu przedstawiający działanie usługi Office 365 Outlook.

Usprawnione połączenie danych

Funkcja Pobierz dane w usłudze Fabric oferuje konfigurację krok po kroku dla potoków kopiowania i nowych połączeń.

Zrzut ekranu przedstawiający nowoczesne i łatwe środowisko pobierania danych.

Zrzut ekranu przedstawiający sposób tworzenia nowego połączenia.

Doświadczenie w zakresie CI/CD

Fabric oddziela procesy CI/CD od szablonów ARM, dzięki czemu można selektywnie wybierać poszczególne elementy obszaru roboczego do zaewidencjonowania, wyewidencjonowania, walidacji i współpracy. Oprócz zewnętrznej integracji repozytorium Git Fabric oferuje wbudowane potoki wdrażania, które nie wymagają repozytorium zewnętrznego.

Monitorowanie centrum i szczegółowych informacji o aktywności

Centrum monitorowania usługi Fabric Data Factory zapewnia wgląd we wszystkie obciążenia w różnych obszarach roboczych oraz możliwość przechodzenia do szczegółów poszczególnych wykonań działań.

Zrzut ekranu przedstawiający centrum monitorowania i elementy usługi Data Factory.

W przypadku działań kopiowania wybierz przycisk Szczegóły przebiegu (ikona okularów), aby wyświetlić podział czasu trwania, który pokazuje, jak długo poszczególne etapy miały miejsce.

Zrzut ekranu przedstawiający wyniki monitorowania przepływu danych w potoku zawiera szczegółowe informacje o aktywności kopiowania.

Zrzut ekranu przedstawiający szczegóły kopiowania danych.

Szybkie duplikowanie przepływu danych

Użyj funkcji Zapisz jako , aby zduplikować dowolny istniejący potok. Służy do tworzenia kopii programistycznych, testowania odmian lub konfigurowania podobnych przepływów pracy.

Zrzut ekranu przedstawiający opcję

Uwaga / Notatka

Nowe funkcje opracowane dla Fabric Data Factory nie są przenoszone do potoków Azure Data Factory ani Azure Synapse. Obie platformy utrzymują oddzielne plany działania. Zespoły produktowe oceniają prośby o backport na podstawie opinii społeczności.

Aby uzyskać więcej informacji, zobacz następujące zasoby: