Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Générez des pipelines Lakeflow en chargeant et en transformant des données, en appliquant des vérifications de qualité des données et en écrivant des résultats dans vos tables cibles. Les rubriques suivantes couvrent les tâches impliquées dans la création et l’exécution de pipelines.
Pour découvrir les concepts déclaratifs derrière des pipelines (jeux de données, flux et graphique de pipeline), consultez Qu’est-ce que les pipelines Lakeflow ?. Pour obtenir une procédure pas à pas, consultez tutoriel : Créer un pipeline ETL à l’aide de la capture de données modifiées.
| Sujet | Description |
|---|---|
| Développer dans l’éditeur Lakeflow Pipelines | Créez, exécutez et déboguez des pipelines dans l’éditeur, avec un graphique de pipeline, des aperçus de données et une exécution sélective. |
| Utiliser Genie Code pour le développement de pipelines | Générez, modifiez et déboguez du code de pipeline à partir d’une invite unique avec le mode Agent de code Genie dans l’éditeur. |
| Gérer les identités et les privilèges | Contrôlez l’identité qui exécute un pipeline et qui peut créer, exécuter, actualiser et afficher des pipelines et leur sortie. |
| Chargement des données | Importez des données dans votre pipeline depuis un stockage d’objets dans le cloud et des bus de messages en continu. |
| Transformer des données | Appliquez des transformations, des jointures et des agrégations pour générer des jeux de données dérivés. |
| Actualisation complète des tables de diffusion en continu | Retraiter toutes les données source pour reconstruire une table de streaming. |
| Qualité des données | Validez les enregistrements avec des attentes et contrôlez ce qui se passe en cas d’échec d’un enregistrement. |
| Écrire des jeux de données | Écrivez les résultats du pipeline vers des destinations telles qu’Apache Kafka et Azure Event Hubs, et utilisez des flux pour écrire vers des cibles de streaming. |
Ressources additionnelles
- Optimiser le traitement avec état à l’aide de repères temporels
- Actualisation incrémentielle pour les vues matérialisées
- Accéder aux vues matérialisées et aux tables de diffusion en continu à l’aide de systèmes externes
- Développer et déboguer des pipelines avec un carnet de notes (ancienne version)
- Développer du code de pipeline dans votre environnement de développement local
- Utiliser des paramètres avec des pipelines
- Convertir un pipeline en projet groupé
- Préparer vos données pour la conformité rgpd