Verschillen tussen Azure Data Factory en Fabric Data Factory

Data Factory in Microsoft Fabric (Fabric Data Factory) is de volgende generatie van Azure Data Factory. Door OneLake te gebruiken als de geïntegreerde opslaglaag, vermindert Fabric Data Factory de complexiteit van de infrastructuur en gegevensverplaatsing. Pijplijnen kunnen rechtstreeks met livegegevens werken via OneLake-snelkoppelingen en delen tussen tenants.

In dit artikel worden de kernfuncties, activiteiten, connectors en infrastructuuronderdelen van beide services vergeleken. Als u een migratie wilt plannen, raadpleegt u de handleiding voor migratieplanning.

Functies naast elkaar vergelijken

Zo stapelen de kernfuncties zich op tussen Azure Data Factory en Fabric Data Factory. In de tabel ziet u wat er is gewijzigd, wat er nieuw is en wat hetzelfde blijft.

Azure Data Factory Data Factory in Fabric Wat is er anders?
Pijpleiding Pijpleiding Betere integratie: Pijplijnen in Fabric werken naadloos samen met Lakehouse, Data Warehouse en andere Fabric-services. Fabric pipelines omvatten meer op SaaS gebaseerde activiteiten en verschillen van JSON-definities. Bekijk de vergelijking van de pijplijnfunctie voor meer informatie.
Gegevenskoppelingstroom Gegevensstroom Gen2 Eenvoudiger te gebruiken: Dataflow Gen2 biedt u een eenvoudigere ervaring voor het bouwen van transformaties. We blijven meer gegevensstroommappingfuncties aan Gen2 toevoegen.
Activiteiten Activiteiten Er komen meer activiteiten: We werken eraan om al uw favoriete ADF-activiteiten naar Fabric te brengen. Bovendien krijgt u nieuwe, zoals de Office 365 Outlook-activiteit die niet beschikbaar is in ADF. Bekijk onze activiteitsvergelijking voor meer informatie.
Gegevensset Alleen verbindingen Eenvoudigere aanpak: Geen complexere configuraties van gegevenssets. Voor Data Factory in Fabric gebruikt u verbindingen om verbinding te maken met uw gegevensbronnen en aan de slag te gaan. Fabric elimineert gegevenssets en definieert gegevenseigenschappen inline binnen activiteiten.
Gekoppelde dienst Verbindingen Intuïtiever: verbindingen werken als gekoppelde services, maar zijn gemakkelijker in te stellen en te beheren.
Aanleidingen Triggers voor plannings- en bestandsevenementen Ingebouwde planning: Gebruik de scheduler- en Reflex-gebeurtenissen van Fabric om uw pijplijnen automatisch uit te voeren. Triggers voor bestandsevenementen werken systeemeigen in Fabric zonder extra instellingen. Fabric integreert triggers in zijn Activator-framework, in tegenstelling tot de zelfstandige triggers van ADF.
Publiceren Opslaan en uitvoeren Geen publicatiestap: sla in Fabric de publicatiestap volledig over. Selecteer Opslaan om uw werk op te slaan of selecteer Uitvoeren om uw pijplijn direct op te slaan en uit te voeren.
Autoresolve en Azure Integration Runtime Niet nodig Vereenvoudigde architectuur: Geen noodzaak om integratieruntimes te beheren. Fabric beheert de berekeningen voor u.
Zelfgehoste integratie runtimes On-premises-gegevensgateway Dezelfde on-premises toegang: maak verbinding met uw on-premises gegevens met behulp van de vertrouwde on-premises gegevensgateway. Meer informatie vindt u in onze handleiding voor on-premises gegevenstoegang.
Azure-SSIS integratieruntimes Te bepalen Toekomstige mogelijkheden in Fabric: we werken nog steeds aan het ontwerp voor SSIS-integratie in Fabric.
Beheerde virtuele netwerken en privé-eindpunten Te bepalen. Toekomstige mogelijkheden in Fabric: we werken nog steeds aan integratie voor beheerde virtuele netwerken en privé-eindpunten in Fabric.
Expressietaal Expressietaal Dezelfde expressies: uw bestaande expressiekennis wordt rechtstreeks overgedragen. De syntaxis is bijna identiek.
Verificatietypen Verificatietypen Meer opties: Al uw populaire ADF-verificatiemethoden werken in Fabric, plus we hebben nieuwe verificatietypen toegevoegd.
CI/CD CI/CD Verbeterde mogelijkheden buiten ADF omvatten eenvoudige selectie van wijzigingen, promotie van afzonderlijke items, activeren van Git-repository's en ingebouwde SaaS CI/CD-opties.
ARM-sjabloon exporteren/importeren Opslaan als Snelle duplicatie: gebruik in Fabric 'Opslaan als' om snel pijplijnen te dupliceren voor ontwikkeling of testen.
Controle Bewakingshub en uitvoeringsgeschiedenis Geavanceerde bewaking: De bewakingshub biedt een moderne ervaring met inzichten in meerdere werkruimten en betere inzoommogelijkheden.
Fouten opsporen Interactieve modus Vereenvoudigd debuggen: Fabric elimineert de debugmodus van ADF. Je bent altijd in interactieve modus.
Gegevensopname wijzigen (CDC) Kopieeropdrachten Incrementele gegevensverplaatsing: Fabric beheert incrementele gegevensverplaatsing via kopieeropdrachten in plaats van CDC-artefacten.
Azure Synapse Link Spiegeling Gegevensreplicatie: Fabric vervangt Azure Synapse Link door spiegelingsfuncties voor gegevensreplicatie.
Pijplijnactiviteit uitvoeren Pijplijnactiviteit aanroepen Cross-platform aanroeping: Fabric verbetert ADF's Execute pipeline-activiteit met cross-platform invocation.

Vergelijking van pijplijnfuncties

Categorie ADF-pijplijnen Fabric-pijplijnen
Type van service PaaS-service voor gegevensintegratie SaaS-service voor gegevensintegratie
Ontwerpomgeving Azure portal (ADF Studio) Fabric / Power BI werkruimte (unified UX met Lakehouses, Warehouses, enz.)
Pijplijnindeling Volledige pijplijnen met activiteiten, triggers, parameters Hetzelfde indelingsmodel, opnieuw voorgesteld voor Fabric UX
Gegevensverplaatsing Kopieeractiviteit, gegevensstromen toewijzen, on-premises IR-ondersteuning, beheerd virtueel netwerk Kopieeractiviteit, Gegevensstromen Gen2, ingebouwde connectiviteit met OneLake- en Fabric-items, OneLake-snelkoppelingen voor live gegevenstoegang zonder kopie, on-premises gegevensgateway, virtuele netwerkgateway
Compute/IR Zelf-hostend, SSIS en Azure IR (voor beweging en transformatie) Cloudverbindingen, on-premises en virtuele netwerkgateway
Gegevensstromen Azure Blob, Data Lake Storage, SQL, 100+ connectoren Dezelfde connectors en native OneLake-integratie, strakkere Fabric-werkruimte-uitlijning
Controle Pijplijnen en gegevensstromen in ADF Studio met uitvoeringen, triggers, waarschuwingen Monitoring van hubs en werkruimten met verenigde weergaven voor pijplijnen, gegevensstromen, notebooks, databases, enzovoort.
Aanleidingen Schema's, tumblingvenster, triggers op basis van gebeurtenissen Schema's, gebeurtenistriggers, tumbling-venstertriggers als intervalschema's. Pijplijnen die gebruikmaken van livegegevens via OneLake-snelkoppelingen en het delen tussen tenants functioneren naadloos met alle typen Fabric-triggers.
CI/CD Integratie van ARM-sjablonen + Azure DevOps of GitHub-repository Ingebouwde implementatiepijplijnen in Fabric; Niveauverhoging op werkruimteniveau (Dev → Test → Production) en externe opslagplaatsintegratie
Security Beheerde identiteiten, Key Vault-integratie, privé-eindpunten Hetzelfde beveiligingsmodel plus Fabric-werkruimte RBAC; integratie van OneLake-beveiliging.
Gegevens delen en gegevensbeheer N/A Gegevens delen tussen tenants via OneLake-snelkoppelingen maakt beheerde, live gegevenstoegang mogelijk binnen organisatiegrenzen zonder duplicatie
Pricing Betalen per gebruik van Azure (per activiteit, gegevensverplaatsing en berekening) Op capaciteit gebaseerde (Fabric F SKU) zonder kosten voor externe activiteiten of pijplijnactiviteiten, alleen activiteitenuitvoeringen en verplaatsing van pijplijngegevens.

Activiteitsvergelijking

Met Data Factory in Microsoft Fabric blijven we een hoge mate van continuïteit met Azure Data Factory behouden. Ongeveer 90% activiteiten die toegankelijk zijn in ADF zijn al beschikbaar onder Data Factory in Fabric. Hier volgt een uitsplitsing van de activiteiten en de beschikbaarheid ervan in zowel ADF als Data Factory in Fabric:

Activity ADF Data Factory in Fabric
ADX/KQL Y Y
Variabele toevoegen Y Y
Aangepast (het Azure Batch in Fabric) Y Y
Azure Databricks NotebookactiviteitJar-activiteitPython-activiteitTaakactiviteit Azure Databricks-activiteit
Azure Machine Learning Y Y
Batchuitvoering van Azure Machine Learning Deprecated N/A
Azure Machine Learning-resource bijwerken Deprecated N/A
Kopiëren Gegevens kopiëren Copy-activiteit
Gegevensstroom Gen2 N/A Y
Delete Y Y
Pijplijn uitvoeren/aanroepen Pijplijn uitvoeren Pijplijn aanroepen
Stof beklede Notebooks N/A Y
Mislukken Y Y
Filter Y Y
Voor elke Y Y
Functions Azure-functie Functieactiviteit
Metagegevens ophalen Y Y
HDInsight Hive-activiteitPig-activiteitMapReduce-activiteitSpark-activiteitStreamingactiviteit HDInsight-activiteit
If-voorwaarde Y Y
Lookup Y Y
Gegevenstroom toewijzen Y Gegevensstroom Gen2
Office 365 Outlook N/A Y
Power Query (alleen ADF - Wrangling-gegevensstroom) Deprecated N/A
Script Y Y
Vernieuwen van semantische modellen N/A Y
Variabele instellen Y Y
Sproc Y Y
SSIS (SQL Server Integration Services) Y N/A
Opgeslagen procedure Y Y
Schakelaar Y Y
Activiteiten van Synapse Notebook en SJD Y N/A
Teams N/A Y
Totdat Y Y
Validation Y Metagegevens ophalen en if-voorwaarde
Wait Y Y
Het web Y Y
Webhaak Y Y
Wrangling-gegevensstroom Y Gegevensstroom Gen2

Nieuwe activiteiten in Fabric Data Factory

Naast het behoud van activiteitencontinuïteit introduceert Data Factory in Fabric enkele nieuwe activiteiten om te voldoen aan uw uitgebreidere indelingsbehoeften. Deze nieuwe activiteiten zijn:

  1. Outlook: beschikbaar in Fabric Data Factory om de integratie met Outlook-services te vergemakkelijken.
  2. Teams: beschikbaar in Fabric Data Factory om indeling van Microsoft Teams-activiteiten mogelijk te maken.
  3. Semantische modelvernieuwing: beschikbaar in Fabric Data Factory om de mogelijkheden voor het vernieuwen van power BI-semantische modellen te verbeteren.
  4. Gegevensstroom Gen2: beschikbaar in Fabric Data Factory om gegevensindeling mogelijk te maken met geavanceerde mogelijkheden voor gegevensstromen.

Zie het overzicht van de activiteit voor een lijst met alle beschikbare Fabric Data Factory-activiteiten.

Connector-vergelijking

Zie het artikel connectorvergelijking voor een vergelijking van alle connectors en hun beschikbaarheid in Azure Data Factory en Fabric Data Factory.

Zelf-gehoste Integration Runtime (SHIR) versus On-premises Data Gateway (OPDG)

Opmerking

De diensten die door SHIR en OPDG worden ondersteund, zijn verschillend:

  • Zelf-hostende Integration Runtime (SHIR): ondersteunt Azure Data Factory, Azure Synapse Analytics, Azure Machine Learning Studio en Azure Purview.
  • On-premises gegevensgateway (OPDG): ondersteunt Power BI, Power Apps, Power Automate, Azure Analysis Services, Logic Apps, Fabric Dataflow Gen2, Fabric Pipeline, Fabric Copy Job en Fabric Mirroring.
Categorie Zelf-gehoste Integration Runtime (SHIR) On-premises gegevensgateway (OPDG)
Ondersteunde diensten - Azure Data Factory
- Azure Machine Learning Studio
- Azure Synapse Analytics
- Azure Purview
- Power BI
- Power Apps
- Power Automate
- Azure Analysis Services
- Logische apps
- Fabric Dataflow Gen2
- Fabricpijplijn
- Fabricopdracht kopiëring
- Fabricspiegeling
Installatie en registratie - Geregistreerd via sleutel
- Wordt uitgevoerd in de servicemodus
- Geregistreerd bij Microsoft Entra ID-account
- Ondersteunt de gebruikersmodus
Platform -Windows
- Ondersteunde containerimage
- Alleen Windows
- Geen containerondersteuning
Proxyondersteuning - Zowel systeem- als aangepaste proxy ondersteunen - Ondersteuning voor aangepaste proxy
Regiokoppeling - Gefixeerd aan de Data-Factory-regio
- Kan de standaardregio niet wijzigen
- Regio kan worden gewijzigd
Aangepast relais - Niet ondersteund -Ondersteund; klanten kunnen hun eigen relay meenemen
Delen in diensten - Gedeeld met maximaal 120 data factory's
- Kan niet worden gedeeld tussen ADF-, Synapse-, Purview- of Synapse-werkruimten
- Beschikbaar voor alle ondersteunde services binnen een tenant
Hoge beschikbaarheid (HA) - Maximaal 8 knooppunten (standaard 4) - Maximaal 10 knooppunten
Recovery - Opnieuw installeren vereist - Herstelsleutel wordt ondersteund
Taakverdeling - Taakniveau-verdeling op basis van het beschikbare aantal werkers (CPU en geheugen) - Taakverdeling op queryniveau
- Opties voor round robin of willekeurige distributie
Inloggegevensopslag - Lokaal opgeslagen op SHIR-knooppunten
- Azure Key Vault ondersteund
- Centraal opgeslagen in gatewaycloudservice
- Geen Key Vault-integratie
Automatisch bijwerken - Ondersteund - Niet ondersteund
Uitbreidbaarheid van connector - Niet ondersteund - Ondersteund
Interactieve auteurschap - Ondersteund - Ondersteund
Private Link voor controlestroom - Ondersteund - Niet ondersteund
Versiebeheer - Twee releases per maand; één gepusht als autoupdate
- Ondersteunt releases van de afgelopen 12 maanden
- Eén release per maand
- Ondersteunt de laatste 6 releases
Cpu- en geheugenbeperking - Niet ondersteund - Ondersteund
Doorvoerlimieten - Geen vaste limiet; afhankelijk van de netwerkbandbreedte Servicespecifieke limieten:
Power Apps/Power Automate/Logic Apps:
- Schrijven: nettoladingslimiet van 2 MB
- Lezen: aanvraaglimiet van 2 MB, 8 MB gecomprimeerde antwoordlimiet
- URL-limiet voor GET-aanvraag: 2048 tekens
Directe Query van Power BI: 16 MB niet-gecomprimeerde antwoordlimiet

ADF Managed Virtual Network versus Fabric Virtual Network Data Gateway

Azure Data Factory (ADF) Managed Virtual Network en Microsoft Fabric Virtual Network (virtueel netwerk) Data Gateway helpen u beide veilig verbinding te maken met gegevensbronnen, zonder ze beschikbaar te maken op het openbare internet. Hoewel beide opties ondersteuning bieden voor privéconnectiviteit voor cloudworkloads, verschillen ze in hoe ze worden ingesteld, wie deze beheert en welke services ze ondersteunen.

  • Door ADF beheerd VNET
    Microsoft is eigenaar van en beheert de netwerkomgeving. U krijgt een eenvoudige installatie, maar u kunt de netwerkinstellingen of firewallregels niet beheren.

  • Fabric VNET-gegevensgateway
    U implementeert de gateway in uw eigen virtuele Azure-netwerk. Hierdoor hebt u volledige controle over netwerken, firewalls en schalen. U bepaalt hoe de gateway verbinding maakt met uw resources en alle netwerkinstellingen beheert.

Gebruik de onderstaande tabel om de belangrijkste verschillen te vergelijken en de optie te kiezen die past bij uw workload- en governancebehoeften.

Categorie Door ADF beheerd virtueel netwerk Fabric virtueel netwerkgegevensgateway
Ondersteunde diensten Azure Data Factory & Synapse-pijplijnen. Microsoft Fabric Dataflow Gen2, Fabric-gegevenspijplijnen, Fabric Copy-taak, Fabric Mirroring, semantische Power BI-modellen en gepagineerde Power BI-rapporten
VNET-eigendom Microsoft-beheerd virtueel netwerk (de klant heeft geen controle over het netwerk). Door de klant beheerd virtueel netwerk (klant heeft volledige controle).
Privé-eindpunten Automatisch gemaakt en beheerd door ADF voor ondersteunde services (Azure Storage, SQL DB, enzovoort). Klanten configureren de gateway van het virtuele netwerk om Fabric-workloads te verbinden met resources binnen hun virtuele netwerk.
Netwerkbeheer Beperkt: klanten kunnen alleen toestaan dat virtuele netwerkintegratieruntime naar privé-eindpunten wordt toegestaan. Volledig beheer: de klant configureert firewalls, NSG-regels, routering in hun eigen virtuele netwerk.
Installatie/implementatie Geen installatie nodig; volledig beheerd door Microsoft in een verborgen virtueel netwerk. Vereist de implementatie van een virtuele netwerkdatagateway in het virtuele netwerk van de klant.
Hoge beschikbaarheid Microsoft-beheerd, automatisch geschaald binnen het virtuele netwerk van ADF. Schakel over naar de reservemodus bij het inschakelen van TTL. Biedt ondersteuning voor schalen en hoge beschikbaarheid (clusters op basis van knooppunten), maar wordt uitgevoerd binnen een door de klant beheerd virtueel netwerk. Ondersteun tot zeven nodes.

mogelijkheden van Fabric Data Factory

Fabric Data Factory bevat Copilot voor Data Factory, die natuurlijke taal gebruikt om pijplijnen, gegevensstromen en andere Data Factory-items te maken en te beheren.

Integratie van Native Lakehouse en Data Warehouse

Een van de grootste voordelen van Fabric Data Factory is hoe deze verbinding maakt met uw gegevensplatforms. Lakehouse en Data Warehouse werken als bronnen en bestemmingen in uw pijplijnen, waardoor u eenvoudig geïntegreerde gegevensprojecten kunt bouwen. Pijplijnen kunnen ook worden uitgevoerd op Lakehouse-tabellen die worden ondersteund door OneLake-snelkoppelingen, zodat u gegevens uit externe bronnen (inclusief cross-tenantshares) kunt transformeren en organiseren zonder deze eerst naar uw werkruimte te kopiëren.

Schermopname met tabblad voor de bron van lakehouse en datawarehouse.

Schermopname met het tabblad voor bestemmingen van lakehouse en datawarehouse.

E-mailmeldingen met Office 365

De Office 365 Outlook-activiteit verzendt aangepaste e-mailmeldingen over pijplijnuitvoeringen, activiteitsstatus en resultaten.

Schermopname van de Office 365 Outlook-activiteit.

Gestroomlijnde gegevensverbindingservaring

De ervaring voor Gegevens ophalen van Fabric biedt een begeleide configuratie voor kopieerpijplijnen en nieuwe verbindingen.

Schermopname van een moderne en eenvoudige Get Data-ervaring.

Schermopname die laat zien hoe u een nieuwe verbinding maakt.

CI/CD-ervaring

Fabric CI/CD loskoppelt van ARM-sjablonen, zodat u afzonderlijke werkruimte-items kunt kiezen voor inchecken, uitchecken, validatie en samenwerking. Naast de integratie van externe Git-opslagplaatsen biedt Fabric ingebouwde implementatiepijplijnen waarvoor geen externe opslagplaats is vereist.

Hub- en activiteitsinzichten bewaken

De Fabric Data Factory-bewakingshub biedt inzicht in alle workloads in meerdere werkruimten, met inzoomen op afzonderlijke activiteitsuitvoeringen.

Schermopname van de bewakingshub en de items van Data Factory.

Bij kopieeractiviteiten selecteert u de knop Uitvoeringsdetails (het brilpictogram) om een tijdsverdeling te bekijken waarin wordt weergegeven hoe lang elke fase duurde.

Schermopname van de resultaten van de bewaking van pijplijnkopie biedt uitsplitsingsdetails van de kopieeractiviteit.

Schermopname toont details van gegevenskopie.

Snelle pijplijnduplicatie

Gebruik de functie Opslaan als om een bestaande pijplijn te dupliceren. Gebruik deze om ontwikkelingskopieën, testvariaties te maken of vergelijkbare werkstromen in te stellen.

Schermopname van

Opmerking

Nieuwe functies die zijn ontwikkeld voor Data Factory in Fabric worden niet teruggezet naar Azure Data Factory of Azure Synapse pijplijnen. De twee platforms onderhouden afzonderlijke roadmaps. De productteams evalueren backportaanvragen op basis van feedback van de community.

Zie de volgende bronnen voor meer informatie: