Bemærk
Adgang til denne side kræver godkendelse. Du kan prøve at logge på eller ændre mapper.
Adgang til denne side kræver godkendelse. Du kan prøve at ændre mapper.
Denne artikel forklarer, hvordan Git-integration for Spark-jobdefinitioner (SJD) i Microsoft Fabric fungerer. Få mere at vide om, hvordan du konfigurerer en lagerforbindelse, administrerer ændringer i Definitionen af Spark-job via kildekontrol og udruller dem på tværs af forskellige arbejdsområder.
Når du aktiverer Git-integration for Spark-jobdefinitioner i Azure DevOps, kan du spore ændringer via hele Git-historikken. Hvis du vælger PySpark eller SparkR, er hoveddefinitionsfilen og referencefilen inkluderet som en del af committen. Git-integration sporer også ændringer i kildekoden i disse filer.
Vigtigt
Denne funktion er en prøveversion.
Konfigurer en forbindelse
Fra indstillingerne for dit arbejdsområde kan du nemt konfigurere en forbindelse til dit lager for at bekræfte og synkronisere ændringer. Hvis du vil konfigurere forbindelsen, skal du se Kom i gang med Git-integration. Efter du har tilsluttet, kan du se dine elementer, såsom definitioner af Spark-job, i Source-kontrolpanelet .
Efter du har committet Spark-jobdefinitionen til Git-repoet, vises jobdefinitionsmappestrukturen i repositoryet.
Spark-jobdefinitionsrepræsentation i Git
Følgende billede viser et eksempel på filstrukturen for hvert Spark-jobdefinitionselement i repo'en:
Når du commmitter Spark-jobdefinitionselementet til repoet, oprettes der en Git-mappe for hvert element og navngives efter dette skema: <Itemnavn> + "SparkJobDefinition". Omdøb ikke mappen, for den bruges til at spore elementet i arbejdsområdet. For eksempel, hvis elementnavnet er "sjd1", er Git-mappens navn "sjd1SparkJobDefinition".
Git-mappen indeholder to undermapper: hovedmappen og referencemappen. Hovedmappen indeholder hoveddefinitionsfilen, og referencemappen indeholder referencefilen.
Ud over de primære filer og referencefilerne er der også en SparkJobDefinitionV1.json fil. Den indeholder metadataene for spark-jobdefinitionselementet, så du skal ikke ændre det. .platform-filen indeholder platforminformationen relateret til Git-opsætning. Ændr heller ikke denne fil.
Bemærk
- Hvis du vælger Java eller Scala som sprog, bliver hoved- og referencefilerne ikke committet, når de uploades som en .jar-fil.
- Det tilknyttede miljø bevares i en Spark-jobdefinition efter synkronisering fra lageret til et Fabric-arbejdsområde. Referencemiljøer på tværs af arbejdsområder understøttes i øjeblikket ikke. Du skal manuelt vedhæfte til et nyt miljø eller bruge standardindstillingerne for arbejdsområdet til at køre jobdefinitionen.
- Spark-jobdefinitionen bevarer standard-lakehouse-id'et, når der synkroniseres fra lageret til et Fabric-arbejdsområde. Hvis du committer en notesbog med standard lakehouse, skal du manuelt referere til et nyoprettet lakehouse-element. Du kan få flere oplysninger under Integration af Lakehouse Git.