Overfør Spark-bassenger fra Azure Synapse Analytics til Fabric

Mens Azure Synapse tilbyr Spark-bassenger, tilbyr Fabric Starter-bassenger og egendefinerte bassenger. Startutvalget kan være et godt valg hvis du har ett enkelt utvalg uten egendefinerte konfigurasjoner eller biblioteker i Azure Synapse, og hvis middels nodestørrelse oppfyller kravene dine. Hvis du imidlertid søker mer fleksibilitet med Konfigurasjonene for Spark-utvalget, anbefaler vi imidlertid å bruke egendefinerte utvalg. Det finnes to alternativer her:

  • Alternativ 1: Du kan bruke migreringsassistenten til å migrere notatbøker fra Azure Synapse til Fabric ved hjelp av en mer veiledet og strømlinjeformet opplevelse.
  • Alternativ 2: Flytt Spark-poolen din til en arbeidsplasss standardpool.
  • Alternativ 3: Flytt Spark-poolen din til et tilpasset miljø i Fabric.

Hvis du har mer enn én Spark-pool og planlegger å flytte disse til samme Fabric-arbeidsområde, anbefalte vi å bruke Alternativ 3, som lager flere tilpassede miljøer og pooler.

Se forskjeller mellom Azure Synapse Spark og Fabric for hensyn til Spark-utvalget.

Forutsetning

Hvis du ikke allerede har en, lag en Fabric workspace i leietakeren din.

Alternativ 1: Bruk migreringsassistent

Du kan bruke migrasjonsassistenten for migrering fra Azure Synapse til Fabric. Den er designet for å gi en veiledet og strømlinjeformet opplevelse for migrering av notatbøker og relaterte ressurser.

Alternativ 2: Fra Spark-poolen til arbeidsområdets standardpool

Du kan opprette et egendefinert Spark-utvalg fra Fabric-arbeidsområdet og bruke det som standardutvalg i arbeidsområdet. Standardutvalget brukes av alle notatblokker og Spark-jobbdefinisjoner i samme arbeidsområde.

Slik flytter du fra et eksisterende Spark-utvalg fra Azure Synapse til et standardutvalg for arbeidsområdet:

  1. Access Azure Synapse-arbeidsområde: Logg på Azure. Gå til Azure Synapse-arbeidsområdet, gå til Analyseutvalg og velg Apache Spark-bassenger.
  2. Finn Spark-bassenget: Finn Spark-bassenget du vil flytte til Fabric, fra Apache Spark-bassenger, og kontroller utvalgets egenskaper.
  3. Hent egenskaper: Få egenskaper for Spark-utvalget, for eksempel Apache Spark-versjon, nodestørrelse, nodestørrelse eller autoskala. Se hensyn til Spark-utvalget for å se eventuelle forskjeller.
  4. Opprett et egendefinert Spark-basseng i Fabric:
    • Gå til fabric-arbeidsområdet, og velg innstillinger for arbeidsområde.
    • Gå til Dataingeniør ing/Vitenskap, og velg Spark-innstillinger.
    • Utvid rullegardinmenyen på Fanen Utvalg og Standardutvalg for arbeidsområde, og velg Opprett nytt utvalg.
    • Opprett det egendefinerte utvalget med tilsvarende målverdier. Fyll ut alternativene for navn, nodefamilie, nodestørrelse, autoskalering og dynamisk fordeling av eksekutor.
  5. Velg en kjøretidsversjon:
    • Gå til Miljø-fanen , og velg den nødvendige Runtime-versjonen. Se tilgjengelige kjøretider her.
    • Deaktiver alternativet Angi standardmiljø.

Skjermbilde som viser standard utvalg.

Merk

I dette alternativet støttes ikke biblioteker eller konfigurasjoner på utvalgsnivå. Du kan imidlertid justere beregningskonfigurasjonen for individuelle elementer, for eksempel notatblokker og Spark-jobbdefinisjoner, og legge til innebygde biblioteker. Hvis du trenger å legge til egendefinerte biblioteker og konfigurasjoner i et miljø, bør du vurdere et egendefinert miljø.

Alternativ 3: Fra Spark-pool til tilpasset miljø

Med egendefinerte miljøer kan du konfigurere egendefinerte Spark-egenskaper og -biblioteker. Slik oppretter du et egendefinert miljø:

  1. Access Azure Synapse-arbeidsområde: Logg på Azure. Gå til Azure Synapse-arbeidsområdet, gå til Analyseutvalg og velg Apache Spark-bassenger.
  2. Finn Spark-bassenget: Finn Spark-bassenget du vil flytte til Fabric, fra Apache Spark-bassenger, og kontroller utvalgets egenskaper.
  3. Hent egenskaper: Få egenskaper for Spark-utvalget, for eksempel Apache Spark-versjon, nodestørrelse, nodestørrelse eller autoskala. Se hensyn til Spark-utvalget for å se eventuelle forskjeller.
  4. Opprette et egendefinert Spark-utvalg:
    • Gå til fabric-arbeidsområdet, og velg innstillinger for arbeidsområde.
    • Gå til Dataingeniør ing/Vitenskap, og velg Spark-innstillinger.
    • Utvid rullegardinmenyen på Fanen Utvalg og Standardutvalg for arbeidsområde, og velg Opprett nytt utvalg.
    • Opprett det egendefinerte utvalget med tilsvarende målverdier. Fyll ut alternativene for navn, nodefamilie, nodestørrelse, autoskalering og dynamisk fordeling av eksekutor.
  5. Opprett et miljøelement hvis du ikke har et.
  6. Konfigurer Spark-databehandling:
    • Gå til Spark Compute Compute i >
    • Velg det nyopprettede utvalget for det nye miljøet.
    • Du kan konfigurere kjerner og minne for driver- og eksekutorer.
  7. Velg en kjøretidsversjon for miljøet. Se tilgjengelige kjøretider her.
  8. Klikk på Lagre og publiser endringer.

Mer informasjon på å opprette og bruke en Miljø.

Skjermbilde som viser tilpasset miljø.