Overzicht van best practices voor Fabric Spark

Deze reeks artikelen geeft best practices voor het optimaliseren van de prestaties, beveiliging en kosten van Spark-taken bij het uitvoeren van Spark Notebooks en Spark job-definities (SJD's) op Fabric. U moet bekend zijn met basisconcepten voor data engineering in Fabric. Als u niet eerder met Fabric werkt, raadpleegt u de documentatie voor Data Engineering van Fabric.

Artikelen in deze reeks

Aanbeveling

Als u nog geen ervaring hebt met Spark, begint u met het artikel Basisbeginselen van Spark .

Acroniemen

Hier volgt een lijst met veelgebruikte acroniems die worden gebruikt in de best practices-artikelen van Fabric Spark:

Acroniem Meaning
AKV Azure Key Vault
AQE Uitvoering van adaptieve query's
CDC Gegevenswijzigingsregistratie
CU Capaciteitseenheid
DAG Gerichte acyclische graaf
HC Hoge mate van gelijktijdigheid
JVM Virtuele Java-machine
MLV Gerealiseerde lakeweergave
Maximaal toelaatbare fout Beheerd privé-eindpunt
NEE Systeemeigen uitvoeringsengine
OOM Onvoldoende geheugen
Polen Private Link
orc Geoptimaliseerde rij-kolomformaat
RDD Tolerante gedistribueerde gegevensset
SJD's Spark-taakdefinities
SPN Naam van de Serviceprincipe
SRE Sitebetrouwbaarheidstechnicus
UDF Door de gebruiker gedefinieerde functie
UI (Gebruikersinterface) Gebruikersinterface
VM Virtuele machine
VNet Virtual Network
WS OAP Beveiliging voor uitgaande toegang van werkruimte