Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Fabric Data Factory to kolejna generacja Azure Data Factory. Dzięki wykorzystaniu usługi OneLake jako ujednoliconej warstwy magazynowania rozwiązanie Fabric Data Factory zmniejsza złożoność infrastruktury i potrzebę przemieszczania danych. Potoki mogą pracować bezpośrednio z danymi na żywo za pomocą skrótów usługi OneLake i współużytkowania między dzierżawami.
W tym artykule porównaliśmy podstawowe funkcje, działania, łączniki i składniki infrastruktury obu usług. Aby zaplanować migrację, zobacz przewodnik planowania migracji.
Porównaj funkcje obok siebie
Poniżej przedstawiono sposób stosu podstawowych funkcji między usługą Azure Data Factory i usługą Fabric Data Factory. Tabela zawiera informacje o tym, co się zmieniło, co nowego i co pozostaje takie same.
| Azure Data Factory | Fabric Data Factory | Co się różni |
|---|---|---|
| rurociąg | rurociąg | Lepsza integracja: Potoki w Fabric działają płynnie z domami nad jeziorem, magazynami i innymi elementami Fabric od razu po wyjęciu z pudełka. Potoki sieci szkieletowej obejmują więcej działań opartych na modelu SaaS i różnią się definicjami JSON. Aby uzyskać więcej informacji, zobacz porównanie funkcji potoku . |
| Mapowanie przepływu danych | Przepływ danych Gen2 | Łatwiejsze w użyciu: przepływ danych Gen2 zapewnia prostsze środowisko tworzenia przekształceń. Cały czas dodajemy więcej funkcji przepływu danych mapowania do usługi Gen2. |
| Działania | Działania | Więcej działań wkrótce: Pracujemy nad przeniesieniem wszystkich Twoich ulubionych działań z usługi ADF do Fabric. Ponadto otrzymujesz nowe funkcje, takie jak działanie Office 365 Outlook, które nie jest dostępne w ADF. Zobacz nasze porównanie działań , aby uzyskać szczegółowe informacje. |
| Zestaw danych | Tylko połączenia | Prostsze podejście: Nie ma bardziej złożonych konfiguracji zestawów danych. W usłudze Fabric Data Factory używasz połączeń, aby połączyć się ze źródłami danych i rozpocząć pracę. Fabric eliminuje zestawy danych, definiując właściwości danych bezpośrednio wewnątrz działań. |
| Połączona usługa | Połączenia | Bardziej intuicyjne: Połączenia działają jak połączone usługi, ale są łatwiejsze do skonfigurowania i zarządzania. |
| Wyzwalacze | Wyzwalacze zdarzeń harmonogramu i plików | Wbudowane planowanie: użyj harmonogramu Fabric i zdarzeń Reflex, aby automatycznie uruchamiać potoki. Wyzwalacze zdarzeń plików działają natywnie w Fabric bez dodatkowej konfiguracji. Fabric integruje wyzwalacze ze swoim frameworkiem Activator, w przeciwieństwie do samodzielnych wyzwalaczy ADF. |
| Publikowanie | Zapisywanie i uruchamianie | Brak kroku publikowania: w usłudze Fabric całkowicie pomiń krok publikowania. Wystarczy wybrać pozycję Zapisz, aby zapisać pracę, lub wybrać pozycję Uruchom, aby zapisać i natychmiast wykonać potok. |
| Autoresolve i Środowisko Uruchomieniowe Azure Integration | Nie jest wymagany | Uproszczona architektura: nie trzeba zarządzać środowiskami Integration Runtime. "Fabric zarządza obliczeniami za ciebie." |
| ** Lokalne składnie uruchomieniowe dla integracji | Lokalna brama danych | Ten sam dostęp lokalny: Połącz się z danymi lokalnie za pomocą znanej bramki danych lokalnej. Dowiedz się więcej w naszym przewodniku po dostępie do danych lokalnych. |
| Środowiska uruchomieniowe integracji Azure-SSIS | Do ustalenia | Przyszłe możliwości w Fabric: nadal pracujemy nad projektem integracji SSIS w Fabric. |
| Zarządzane sieci wirtualne i prywatne punkty końcowe | Do ustalenia. | Przyszłe możliwości w Fabric: nadal pracujemy nad integracją z zarządzanymi sieciami wirtualnymi i prywatnymi punktami końcowymi w ramach Fabric. |
| Język wyrażeń | Język wyrażeń | Te same wyrażenia: istniejące wyrażenia bezpośrednio przenoszą wiedzę. Składnia jest prawie identyczna. |
| Typy uwierzytelniania | Rodzaje uwierzytelniania | Więcej opcji: Wszystkie popularne metody uwierzytelniania usługi ADF działają w Fabric, a także dodaliśmy nowe typy uwierzytelniania. |
| ciągła integracja/ciągłe wdrażanie | ciągła integracja/ciągłe wdrażanie | Ulepszone możliwości poza usługą ADF obejmują łatwe wybieranie elementów, podwyższanie poziomu poszczególnych elementów, włączanie repozytorium Git i wbudowane opcje ciągłej integracji/ciągłego wdrażania SaaS. |
| Eksportowanie/importowanie szablonu ARM | Zapisz jako | Szybkie duplikowanie: W Fabric użyj polecenia "Zapisz jako", aby szybko duplikować przepływy na potrzeby rozwoju lub testowania. |
| Monitorowanie | Centrum monitorowania i historia uruchamiania | Zaawansowane monitorowanie: Centrum monitorowania oferuje nowoczesne środowisko ze szczegółowymi informacjami między obszarami roboczymi i lepszymi możliwościami zagłębiania się w szczegóły. |
| Debugowanie | Tryb interaktywny | Uproszczone debugowanie: Fabric eliminuje tryb debugowania ADF. Zawsze jesteś w trybie interaktywnym. |
| Przechwytywanie zmian danych (CDC) | Zadania kopiowania | Przyrostowe przenoszenie danych: Fabric obsługuje przyrostowe przenoszenie danych za pomocą zadań kopiowania zamiast artefaktów CDC. |
| Azure Synapse Link | Odwzorowywanie | Replikacja danych: sieć szkieletowa zastępuje usługę Azure Synapse Link funkcjami dublowania na potrzeby replikacji danych. |
| Wykonywanie działania potoku | Uruchom działanie potoku | Wywołanie międzyplatformowe: Fabric rozszerza działanie Execute Pipeline w usłudze ADF o obsługę wywołań międzyplatformowych. |
Porównanie funkcji potoku
| Kategoria | Potoki ADF | Potoki sieci szkieletowej |
|---|---|---|
| Typ usługi | Usługa PaaS integracji danych | Usługa SaaS integracji danych |
| Środowisko do tworzenia treści | portal Azure (ADF Studio) | Fabric / Power BI workspace (zunifikowane UX z domami nad jeziorem, magazynami itd.) |
| Orkiestracja potoku | Potoki w pełni funkcjonalne z działaniami, wyzwalaczami, parametrami | Ten sam model orkiestracji, przemyślany na nowo dla interfejsu użytkownika Fabric. |
| Przenoszenie danych | Kopiowanie danych, mapowanie przepływów danych, obsługa lokalnego IR, zarządzana sieć wirtualna | działanie kopiowania, Dataflows Gen2, wbudowana łączność z usługą OneLake i elementami usługi Fabric, skróty OneLake umożliwiające dostęp na żywo do danych bez kopiowania, lokalna brama danych, brama sieci wirtualnej |
| Środowisko obliczeniowe/środowisko IR | Lokalnie hostowane, SSIS i Azure IR (do przenoszenia i przekształcania) | Połączenia w chmurze, lokalne i brama sieci wirtualnej |
| Przepływy danych | Azure Blob, magazyn Data Lake, SQL, ponad 100 konektorów | Te same łączniki i natywna integracja OneLake, ściślejsza integracja obszaru roboczego Fabric |
| Monitorowanie | potoki i przepływy danych w ADF Studio obejmujące uruchomienia, wyzwalacze i alerty | Centrum monitorowania i monitorowanie obszaru roboczego z ujednoliconymi widokami obejmującymi potoki, przepływy danych, notesy, bazy danych itd. |
| Wyzwalacze | Harmonogramy, okna przesuwne, wyzwalacze oparte na zdarzeniach | Harmonogramy, wyzwalacze zdarzeń, wyzwalacze okna wirowania jako harmonogramy interwałów. Potoki korzystające z danych na żywo za pośrednictwem skrótów usługi OneLake i współużytkowania między dzierżawami bezproblemowo współpracują ze wszystkimi typami wyzwalaczy Fabric. |
| ciągła integracja/ciągłe wdrażanie | Szablony usługi ARM i integracja z usługą Azure DevOps lub repozytorium GitHub | Wbudowane potoki wdrażania w Fabric; promocja na poziomie obszaru roboczego (Deweloperskie → Test → Produkcja) i integracja zewnętrznego repozytorium |
| Zabezpieczenia | Tożsamości zarządzane, integracja z Key Vault, prywatne punkty końcowe | Ten sam model zabezpieczeń plus RBAC w obszarze roboczym Fabric; Integracja zabezpieczeń z OneLake |
| Udostępnianie danych i nadzór | N/A | Udostępnianie danych między dzierżawami za pośrednictwem skrótów OneLake umożliwia zarządzany dostęp do danych na żywo przez granice organizacji bez duplikowania |
| Pricing | Płatność zgodnie z rzeczywistym poziomem wykorzystania na platformie Azure (na podstawie uruchamiania działań, przenoszenia danych i mocy obliczeniowej) | Jednostka SKU oparta na pojemności (Fabric F SKU) bez opłat za działania zewnętrzne lub aktywności związane z potokami, jedynie za uruchomienia działań i przenoszenie danych w potokach. |
Porównanie działań
Dzięki Data Factory nadal utrzymujemy wysoki stopień ciągłości z Data Factory. Około 90% aktywności dostępnych w ADF jest już dostępnych w ramach Data Factory. Oto przegląd działań i ich dostępności zarówno w ADF, jak i Data Factory:
| Activity | ADF | Fabryka danych |
|---|---|---|
| ADX/KQL | Y | Y |
| Dołącz zmienną | Y | Y |
| Niestandardowe (usługa Azure Batch w sieci szkieletowej) | Y | Y |
| Azure Databricks | Działanie notebooka • Uruchomienie JAR-a • Działanie Pythona • Proces zadania | Działanie usługi Azure Databricks |
| Azure Machine Learning | Y | Y |
| Wykonywanie wsadowe w usłudze Azure Machine Learning | Deprecated | N/A |
| Zasób aktualizacji usługi Azure Machine Learning | Deprecated | N/A |
| Kopiuj | Kopiowanie danych | operacja kopiowania |
| Przepływ danych Gen2 | N/A | Y |
| Usuń | Y | Y |
| Uruchomienie/Wywołanie Pipeline'u | Wykonywanie pipeline | Wywołaj potok |
| Notatniki Fabric | N/A | Y |
| Błąd | Y | Y |
| Filter | Y | Y |
| Dla każdego | Y | Y |
| Functions | Funkcja platformy Azure | Działanie funkcji |
| Pobieranie metadanych | Y | Y |
| HDInsight | Aktywność Hive • Aktywność Pig • Aktywność MapReduce • Aktywność Spark • Aktywność przesyłania strumieniowego | Działanie usługi HDInsight |
| Instrukcja warunkowa if | Y | Y |
| Szukaj | Y | Y |
| Mapowanie przepływu danych | Y | Przepływ danych Gen2 |
| Office 365 Outlook | N/A | Y |
| Power Query (tylko usługa ADF — uzdatnianie przepływu danych) | Deprecated | N/A |
| Skrypt | Y | Y |
| Odświeżenie modelu semantycznego | N/A | Y |
| Ustaw zmienną | Y | Y |
| Sproc | Y | Y |
| SSIS | Y | N/A |
| procedura składowana | Y | Y |
| Przełącznik | Y | Y |
| Działania Synapse Notebook i SJD | Y | N/A |
| Zespoły | N/A | Y |
| Aż do | Y | Y |
| Validation | Y | Pobieranie metadanych i konstrukcja if |
| Wait | Y | Y |
| sieć Web | Y | Y |
| Webhook | Y | Y |
| Zarządzanie przepływem danych | Y | Przepływ danych Gen2 |
Nowe działania w usłudze Fabric Data Factory
Oprócz utrzymania ciągłości aktywności, Fabric Data Factory wprowadza nowe aktywności, które zaspokoją Twoje bogatsze potrzeby orkiestracyjne. Te nowe działania to:
- Outlook: dostępna w usłudze Fabric Data Factory w celu ułatwienia integracji z usługami Outlook.
- Zespoły: dostępne w usłudze Fabric Data Factory w celu umożliwienia orkiestracji działań usługi Microsoft Teams.
- Odświeżanie modelu semantycznego: dostępne w usłudze Fabric Data Factory, aby zwiększyć możliwości odświeżania modelu semantycznego usługi Power BI.
- Dataflow Gen2: dostępna w usłudze Fabric Data Factory w celu umożliwienia orkiestracji danych dzięki zaawansowanym funkcjom przepływu danych.
Aby uzyskać listę wszystkich dostępnych działań usługi Fabric Data Factory, zobacz Omówienie działania.
Porównanie łączników
Porównanie wszystkich łączników i ich dostępności w usługach Azure Data Factory i Fabric Data Factory można znaleźć w artykule Porównanie łączników.
Własne środowisko Integration Runtime (SHIR) a lokalna brama danych (OPDG)
Uwaga / Notatka
Usługi wspierane przez SHIR i OPDG są różne:
- Lokalne środowisko Integration Runtime: Obsługuje Data Factory, Azure Synapse Analytics, Azure Machine Learning studio oraz Azure Purview.
- Brama danych lokalna: Obsługuje Power BI, Power Apps, Power Automate, Azure Analysis Services, Logic Apps, Fabric dataflow Gen2, Fabric pipeline, Fabric copy job oraz Fabric mirroring.
| Kategoria | Samodzielnie hostowane środowisko uruchomieniowe integracji (Self-hosted Integration Runtime, SHIR) | Lokalna brama danych (OPDG) |
|---|---|---|
| Obsługiwane usługi | — Azure Data Factory — Azure Machine Learning Studio — Azure Synapse Analytics — Azure Purview |
— Power BI — Power Apps — Power Automate — Azure Analysis Services - Aplikacje logiczne - Przepływ danych Fabric Gen2 — Potok sieci szkieletowej - Zadanie kopiowania sieci szkieletowej - Dublowanie Fabric w sieci |
| Instalacja i rejestracja | - Zarejestrowane z użyciem klucza - Działa w trybie usługi |
— Zarejestrowane przy użyciu konta Microsoft Entra ID - Obsługuje tryb użytkownika |
| Platform | -Windows — Obsługiwany obraz kontenera |
— Tylko system Windows — Brak obsługi kontenerów |
| Obsługa serwera proxy | — Obsługa zarówno systemu, jak i niestandardowego serwera proxy | - Obsługa niestandardowego serwera proxy |
| Powiązanie regionu | Poprawiono z przypisaniem do regionu usługi Data Factory — Nie można zmienić regionu domyślnego |
- Region można zmienić |
| Przekaźnik niestandardowy | - Nie obsługiwane | - Obsługiwane; klienci mogą przywieźć swój własny przekaźnik |
| Udostępnianie między usługami | — Udostępnione maksymalnie 120 fabrykom danych — Nie można udostępniać ich w obszarach roboczych usług ADF, Synapse, Purview lub Synapse |
— Dostępne dla wszystkich obsługiwanych usług w ramach klienta |
| Wysoka dostępność (HA) | - Do 8 węzłów (domyślnie 4) | - Maksymalnie 10 węzłów |
| Recovery | — Wymaga ponownej instalacji | — Obsługiwany klucz odzyskiwania |
| Równoważenie obciążenia | - Równoważenie obciążenia na poziomie zadania na podstawie dostępnej liczby pracowników (procesor i pamięć) | - Równoważenie obciążenia na poziomie zapytania - Opcje działania okrężnego lub dystrybucji losowej |
| Magazyn poświadczeń | - Przechowywane lokalnie w węzłach SHIR — Obsługiwana usługa Azure Key Vault |
Centralnie przechowywane w usłudze chmury Gateway — Brak integracji z usługą Key Vault |
| Automatyczna aktualizacja | - Obsługiwane | - Nie obsługiwane |
| Rozszerzalność łącznika | - Nie obsługiwane | - Obsługiwane |
| Tworzenie interakcyjne | - Obsługiwane | - Obsługiwane |
| Usługa Private Link dla przepływu sterowania | - Obsługiwane | - Nie obsługiwane |
| Wersjonowanie | - Dwie wersje miesięcznie; jedna dostarczana jako autoaktualizacja — Obsługuje ostatnie 12 miesięcy wydań |
- Jedna wersja miesięcznie - Obsługuje ostatnie 6 wydań |
| Ograniczanie wydajności procesora i pamięci | - Nie obsługiwane | - Obsługiwane |
| Limity przepływności | - Brak twardego limitu; zależne od przepustowości sieci | Limity specyficzne dla usługi: Power Apps/Power Automate/ Logic Apps: - Zapisz: limit ładunku 2 MB - Odczyt: limit żądań 2 MB, limit odpowiedzi skompresowanej 8 MB - Limit adresów URL żądania GET: 2048 znaków Power BI DirectQuery: limit odpowiedzi nieskompresowanej 16 MB |
Zarządzana sieć wirtualna ADF a brama danych sieci wirtualnej Fabric
Zarządzana sieć wirtualna Azure Data Factory (ADF) oraz brama danych sieci wirtualnej (VNet) platformy Fabric umożliwiają bezpieczne łączenie ze źródłami danych bez udostępniania ich w publicznym Internecie. Chociaż obie opcje obsługują łączność prywatną dla obciążeń w chmurze, różnią się one sposobem ich konfigurowania, kto nimi zarządza i które usługi obsługują.
Zarządzana sieć wirtualna ADF
Firma Microsoft jest właścicielem środowiska sieciowego i zarządza nim. Uzyskasz prostą konfigurację, ale nie możesz kontrolować ustawień sieci ani reguł zapory.Fabric VNET data gateway Bramę wdrażasz we własnej wirtualnej sieci platformy Azure. Zapewnia to pełną kontrolę nad siecią, zaporą i skalowaniem. Decydujesz, jak brama łączy się z Twoimi zasobami i zarządzasz wszystkimi ustawieniami sieci.
Skorzystaj z poniższej tabeli, aby porównać główne różnice i wybrać opcję pasującą do potrzeb związanych z obciążeniem i zarządzaniem.
| Kategoria | Zarządzana sieć VNet usługi ADF | Fabric VNet data gateway |
|---|---|---|
| Obsługiwane usługi | Potoki usługi Azure Data Factory i Synapse. | Przepływy danych Fabric Gen2, potoki danych Fabric, zadanie kopiowania Fabric, replikacja lustrzana Fabric, modele semantyczne Power BI oraz raporty stronicowane Power BI |
| Własność sieci wirtualnej | Wirtualna sieć zarządzana przez Microsoft (klient nie kontroluje sieci). | Zarządzana przez klienta sieć wirtualna (klient ma pełną kontrolę). |
| Prywatne punkty końcowe | Automatycznie tworzone i zarządzane przez ADF dla obsługiwanych usług (Azure Storage, SQL DB itp.). | Klienci konfigurują bramę sieci wirtualnej, aby łączyć obciążenia Fabric z zasobami wewnątrz swojej sieci wirtualnej. |
| Kontrolka sieci | Ograniczone — klienci mogą zezwalać tylko na dodawanie środowiska Integration Runtime sieci wirtualnej do prywatnych punktów końcowych. | Pełna kontrola — klient konfiguruje zaporę, reguły NSG i trasowanie w swojej sieci wirtualnej. |
| Instalacja/wdrożenie | Nie jest wymagana instalacja; w pełni zarządzana przez firmę Microsoft wewnątrz ukrytej sieci wirtualnej. | Wymaga wdrożenia bramki danych sieci wirtualnej w sieci wirtualnej klienta. |
| Wysoka dostępność | Zarządzane przez Microsoft, automatycznie skalowane w wirtualnej sieci ADF. Przełącz na tryb zapasowy podczas włączania TTL. | Obsługuje skalowanie i wysoką dostępność (klastry oparte na węzłach), ale działa w sieci wirtualnej zarządzanej przez klienta. Obsługuje do siedmiu węzłów. |
Możliwości usługi Data Factory w usłudze Fabric
usługa Fabric Data Factory zawiera Copilot dla usługi Data Factory, która używa języka naturalnego do tworzenia potoków, przepływów danych i innych elementów usługi Data Factory oraz zarządzania nimi.
Integracja rodzimych domów nad jeziorem i magazynu
Jedną z największych zalet usługi Fabric Data Factory jest sposób łączenia się z platformami danych. Domy nad jeziorem i magazyny w Fabric działają zarówno jako źródła, jak i miejsca docelowe w Twoich pipeline'ach, co ułatwia budowanie zintegrowanych projektów danych. Potoki mogą również działać w tabelach typu lakehouse wspieranych przez skróty oneLake, co umożliwia przekształcanie i organizowanie danych ze źródeł zewnętrznych (w tym udziałów między dzierżawami) bez uprzedniego kopiowania ich do obszaru roboczego.
Powiadomienia e-mail z Office 365
Działanie Office 365 Outlook wysyła dostosowane powiadomienia e-mail dotyczące uruchomień potoku, stanu działania i wyników.
Usprawnione połączenie danych
Funkcja Pobierz dane w usłudze Fabric oferuje konfigurację krok po kroku dla potoków kopiowania i nowych połączeń.
Doświadczenie w zakresie CI/CD
Fabric oddziela procesy CI/CD od szablonów ARM, dzięki czemu można selektywnie wybierać poszczególne elementy obszaru roboczego do zaewidencjonowania, wyewidencjonowania, walidacji i współpracy. Oprócz zewnętrznej integracji repozytorium Git Fabric oferuje wbudowane potoki wdrażania, które nie wymagają repozytorium zewnętrznego.
Monitorowanie centrum i szczegółowych informacji o aktywności
Centrum monitorowania usługi Fabric Data Factory zapewnia wgląd we wszystkie obciążenia w różnych obszarach roboczych oraz możliwość przechodzenia do szczegółów poszczególnych wykonań działań.
W przypadku działań kopiowania wybierz przycisk Szczegóły przebiegu (ikona okularów), aby wyświetlić podział czasu trwania, który pokazuje, jak długo poszczególne etapy miały miejsce.
Szybkie duplikowanie przepływu danych
Użyj funkcji Zapisz jako , aby zduplikować dowolny istniejący potok. Służy do tworzenia kopii programistycznych, testowania odmian lub konfigurowania podobnych przepływów pracy.
Treści powiązane
Uwaga / Notatka
Nowe funkcje opracowane dla Fabric Data Factory nie są przenoszone do potoków Azure Data Factory ani Azure Synapse. Obie platformy utrzymują oddzielne plany działania. Zespoły produktowe oceniają prośby o backport na podstawie opinii społeczności.
Aby uzyskać więcej informacji, zobacz następujące zasoby: