Vue d’ensemble des meilleures pratiques de Fabric Spark

Cette série d’articles présente les meilleures pratiques pour optimiser les performances, la sécurité et le coût des tâches Spark lors de l’exécution des notebooks Spark et des définitions de tâches Spark (SJD) sur Fabric. Vous devez être familiarisé avec les concepts de base de l’ingénierie des données dans Fabric. Si vous débutez avec Fabric, reportez-vous à la documentation d’ingénierie des données Fabric.

Articles de cette série

Conseil / Astuce

Si vous débutez avec Spark, commencez par l’article De base de Spark .

Acronymes

Voici une liste des acronymes courants utilisés dans les articles sur les meilleures pratiques Fabric Spark :

Acronyme Signification
AKV Azure Key Vault
AQE Exécution de requête adaptative
CDC Capture de données modifiées
CU Unité de capacité
DAG Graphe orienté acyclique
HC Concurrence élevée
JVM Machine virtuelle Java
MLV Vue matérialisée du lac
MPE Point de terminaison privé managé
NEE Moteur d'exécution natif
OOM Mémoire insuffisante
PL Private Link
ORC Colonnes de lignes optimisées
RDD Jeu de données distribué résilient
SJDs Définitions de travaux Spark
SPN Nom du principal de service
SRE Ingénieur fiabilité du site
Fonctions définies par l'utilisateur Fonction définie par l’utilisateur
IU Interface utilisateur
Machine virtuelle Machine virtuelle
Réseau virtuel Réseau virtuel
WS OAP Protection de l’accès sortant de l’espace de travail