Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
Este tutorial le guía a través de un escenario de integración de datos completo en aproximadamente una hora. Aprenderá las funcionalidades clave de Data Factory en Microsoft Fabric y cómo aplicarlas a flujos de trabajo de datos comunes.
Lo que vas a construir
Este tutorial incluye una introducción y tres módulos:
- Módulo 1: Ingesta de datos con un trabajo de Copia: Crea un trabajo de Copia independiente para ingir datos en bruto del almacenamiento de Blob en una tabla de bronce en un Lakehouse.
- Módulo 2: Transformar datos con un flujo de datos: procese los datos sin procesar de su tabla bronze y trasládelo a una tabla gold en el Lakehouse.
- Módulo 3: Orquestar y automatizar con una canalización: Crear una tubería para orquestar el trabajo de copia y el flujo de datos, enviar una notificación por correo electrónico cuando los trabajos se completen y programar todo el flujo.
Data Factory en Microsoft Fabric
Microsoft Fabric es una plataforma de análisis unificada que cubre el movimiento de datos, lagos de datos, ingeniería de datos, integración de datos, ciencia de datos, análisis en tiempo real e inteligencia empresarial. No es necesario unir servicios de varios proveedores.
Data Factory en Fabric combina la facilidad de uso de Power Query con la escala de Azure Data Factory. Ofrece preparación de datos habilitada para inteligencia artificial, transformación a escala de petabyte y cientos de conectores con conectividad híbrida y multinube, todo ello con bajo código.
Características clave
Data Factory proporciona tres funcionalidades principales para sus necesidades de integración de datos:
- Ingesta de datos con trabajo de copia: un trabajo de copia es el punto de partida recomendado para la ingesta de datos. Mueve datos a escala petabyte de cientos de fuentes de datos a tu Lakehouse, con soporte nativo para copias masivas, incrementales y de captura de datos por cambios (CDC), sin necesidad de construir una pipeline.
- Transformación de datos: Dataflow Gen2 proporciona una interfaz de poco código para transformar los datos con más de 300 transformaciones. Puede cargar resultados en varios destinos, como Azure SQL Database, Lakehouse, etc.
- Automatización de un extremo a otro: las canalizaciones orquestan actividades como trabajo de copia, flujos de datos, cuadernos y más. Encadene las actividades para ejecutarse secuencialmente o en paralelo. Supervise todo el flujo de integración de datos en un solo lugar.
Arquitectura del tutorial
Explorará las tres características clave a medida que complete un escenario de integración de datos de un extremo a otro.
El escenario incluye tres módulos:
- Ingerir datos con un trabajo de copia: Crear un trabajo de copia independiente para ingerir datos de ejemplo en una tabla bronze de un Lakehouse.
- Transformar datos con un flujo de datos: procese los datos sin procesar de su tabla bronze y muévelos a una tabla gold.
- Orquestar y automatizar con una canalización: cree una canalización para organizar el flujo de datos y el trabajo de copia, enviar una notificación por correo electrónico y programar todo el flujo.
En este tutorial se usa el conjunto de datos de ejemplo NYC-Taxi . Cuando termine, puede analizar los descuentos diarios en tarifas de taxi durante un período de tiempo específico mediante Data Factory en Microsoft Fabric.