Konfigurer tilpassede live pools i Microsoft Fabric

Gjelder for:✅ Fabric Data Engineering og Data Science

Skreddersydde live pools er prehydrerte Spark-klynger som gir nesten umiddelbar oppstart av økter for notatbøker i Fabric. Denne artikkelen viser hvordan man oppretter, konfigurerer og administrerer tilpassede live pools for optimal ytelse.

Forutsetninger

Før du setter opp tilpassede live pools, sørg for at du har:

  • Tilgang til et Fabric-arbeidsområde med en betalt Fabric SKU (Fabric testkapasiteter støttes ikke).
  • Admin- eller medlemsrolle i arbeidsområdet.
  • En aktiv Fabric-kapasitet er tildelt arbeidsplassen din.
  • Et publisert Fabric-miljø til bruk for bibliotekkonfigurasjon.
  • En eksisterende tilpasset Spark-pool. Kun arbeidsområdeadministratorer kan lage tilpassede Spark-pooler.

Hvis du har Medlem-rollen , må en arbeidsområdeadministrator aktivere den eksisterende innstillingen Tilpass beregningskonfigurasjon for gjenstander arbeidsområde.

Viktig!

Starterpooler støttes ikke for tilpassede live pools. Hvis arbeidsområdet ditt bruker en startpool, må du opprette en egendefinert Spark-pool før du konfigurerer en egendefinert live pool.

Bruk den eksisterende innstillingen for beregningstilpasning

Egendefinerte live pools bruker den eksisterende innstillingen Customize compute for items workspace. De har ikke en egen delegasjonsinnstilling. Før et arbeidsområdemedlem kan opprette eller oppdatere en tilpasset live pool-konfigurasjon, må en arbeidsområdeadministrator aktivere den eksisterende innstillingen:

  1. Gå til fabric-arbeidsområdet.

  2. Velg Workspace-innstillinger fra Workspace Home-båndet.

  3. Utvid Data Engineering/Science og velg Spark-innstillinger.

  4. Velg fanen Pool .

  5. Slå på Tilpass beregningskonfigurasjon for elementer.

    Skjermbilde som viser bryteren for å tilpasse beregningskonfigurasjonen for elementer.

  6. Velg Lagre.

Når denne innstillingen er aktivert, kan medlemmer bruke et Fabric-miljø til å velge en eksisterende tilpasset Spark-pool, justere driverkjerner på sesjonsnivå, driverminne, executor-kjerner og executor-minne, og opprette eller oppdatere live pool-konfigurasjonen. Medlemmer kan deretter lagre og publisere miljøet.

Denne innstillingen lar ikke medlemmer opprette eller administrere egendefinerte Spark-pooler i arbeidsområdets innstillinger. En arbeidsområdeadministrator må opprette den underliggende tilpassede Spark-poolen.

Når Tilpasset beregningskonfigurasjon for elementer er av, bruker miljøene arbeidsområdets standardpool og dens beregningskonfigurasjon. Medlemmer kan ikke opprette eller oppdatere en tilpasset live pool-konfigurasjon før en arbeidsområdeadministrator aktiverer innstillingen.

For mer informasjon om denne arbeidsområdets kontroll, se Data Engineering arbeidsområdeadministrasjonsinnstillinger.

Opprett en egendefinert pool for live poolen (kun administrator)

Denne oppgaven krever rollen som Admin-arbeidsområde . Hvis en tilpasset Spark-pool allerede eksisterer, kan arbeidsområdemedlemmer hoppe over denne oppgaven og konfigurere live pool-beregning på den eksisterende poolen.

  1. Naviger til Fabric-arbeidsområdet ditt.
  2. Velg Workspace-innstillinger fra Workspace Home-båndet.
  3. Utvid Data Engineering/Science og velg Spark-innstillinger.
  4. Velg fanen Pool .
  5. Fra nedtrekksmenyen Default pool for workspace , velg Ny pool.
  6. Skriv inn et navn på bassenget. Dette navnet er en unik identifikator for poolen, slik som dev-team-pool eller prod-daily-analytics.
  7. Velg en nodefamilie og nodestørrelse for arbeidsmengden din.
  8. Velg avkrysningsboksen for Autoscale for å aktivere autoskalering for poolen.

Konfigurer en live pool

Workspace-administratorer og medlemmer kan opprette eller oppdatere en live pool-konfigurasjon gjennom miljøinnstillingene . For medlemmer må en arbeidsområdeadministrator først aktivere Tilpass beregningskonfigurasjon for elementer. Medlemmer må velge en eksisterende tilpasset Spark-pool opprettet av en arbeidsområdeadministrator.

  1. I ditt Fabric-arbeidsområde, åpne miljøet du vil koble til en tilpasset live pool.

  2. Velg Compute i venstre rute.

  3. Velg poolen du opprettet i forrige steg fra nedtrekksmenyen.

  4. Under Live pool, velg radioknappen for å aktivere live pool-beregning for dette miljøet.

    Skjermbilde som viser Live pool-radioknappen aktivert i miljøet Compute-innstillinger.

  5. Under Live pool-planen, velg radioknappen for å slå den på. Alle tilpassede live pools må ha en tidsplan. Klaser holdes kun hydrert i det planlagte vinduet.

  6. Spesifiser tidsplaninnstillingene:

    • Om timeplanen er gjentakende
    • Start- og sluttdag og tid
    • Tidssone
    • Når man skal deaktivere og reaktivere bassenget
    • Andre innstillinger etter behov

    Viktig!

    Fabric bruker standard Spark-provisionering for aktivitet utenfor det planlagte vinduet, som har tregere oppstartstider. Klynger holdes ikke varme utenfor det planlagte vinduet.

    For tips til planlegging, se Beste praksis for timeplan.

  7. Lagre beregningsinnstillingene.

  8. Velg Publiser-knappen i det øverste båndet.

Etter at du publiserer, er bassenget aktivt og Fabric begynner å hydrere klynger før neste planperiode.

Bemerkning

Publisering kan ta flere minutter.

Eventuelle endringer i miljøet krever at miljøet publiseres på nytt og hydrerte klynger fornyes.

Forstå tidsplanvinduet

Planen definerer vinduet når Fabric holder klynger hydrert og kan rehydrere klynger den har deaktivert. Det holder ikke live poolen varm utenfor det konfigurerte vinduet.

For eksempel, vurder en tilbakevendende tidsplan som går hver dag fra kl. 08:00 til 17:00:

  • Klokken 08:00 starter det daglige rutinevinduet, og Fabric starter eller fortsetter å hydrere.
  • I planleggingsvinduet kan en inaktivklynge deaktiveres etter den konfigurerte inaktivtidsavbruddet. Fabric kan rehydrere en erstatning i henhold til det konfigurerte reaktiveringsintervallet.
  • Klokken 17:00 avsluttes timeplanen. Fabric fortsetter ikke å rehydrere klaser mellom kl. 17:00 og 08:00 neste dag.
  • En notatbok som sendes inn utenfor tidsplanvinduet bruker standard Spark-provisjonering og får ikke live pool-varmestart-fordelen.
  • Den samme daglige oppførselen gjentar seg frem til den konfigurerte sluttdatoen for planen.

Starttidspunktet garanterer ikke at en klynge allerede er tilgjengelig akkurat da. Hydrering tar tid, spesielt etter en miljøoppdatering eller når Fabric må opprette en ny klynge. Hvis en planlagt notatbok må starte kl. 08:00, start live pool-planen 60-90 minutter tidligere. Før notatboken kjøres, bruk overvåkingshuben for å bekrefte at tilgjengelige klynger er større enn null. En innkommende notatbok får en varm økt kun når en kompatibel hydrert klynge er tilgjengelig.

Overvåk poolstatus

For å sjekke statusen på ditt tilpassede levende basseng:

  1. I Fabric-portalen, åpne overvåkingshuben.

  2. Finn miljøet du publiserte og velg ellipsen (...) for å åpne kontekstmenyen.

  3. Velg Vis detaljer.

    Skjermbilde som viser Live pool-statusen i overvåkingshuben.

  4. I høyre panel, utvid Live pool-status for å se poolens nåværende tilstand.

Live pool-statusen inkluderer detaljer som:

  • Bassengstatus: For eksempel Aktiv, Hydrerende, Inaktiv eller Stoppet
  • Tilgjengelige klynger: Antall klynger klare for notatbokøkter
  • Travle klynger: Antall klynger som for øyeblikket kjører økter
  • Neste tidsplan: Kommende aktivitetsvindu

Beste fremgangsmåter

For å få mest mulig ut av tilpassede live pools, vurder følgende beste praksis for konfigurasjon og administrasjon:

Optimaliser for kostnad og ytelse

  • Samsvar antall med etterspørsel: Sett maks antall klynger basert på forventede samtidige økter. Overforsyning øker kostnadene.
  • Overvåk utnyttelsen: Gå jevnlig gjennom pool-målinger og juster antall klynger om nødvendig.
  • Skaler tidsplaner effektivt: Unngå overlappende tidsplaner på tvers av flere pooler med mindre det er nødvendig.
  • Utnytt ledig tidsavbrudd: Sett passende inaktive tidsavbrudd for å opprettholde en balanse mellom ressurstilgjengelighet og å unngå hyppige omstarter av klyngen.

Klyngestørrelse

Når du konfigurerer poolen din, bør du vurdere følgende innstillinger og anbefalinger:

  • Klyngestørrelse: Antall eksekverinstanser for notatbokøkter (område: 1-16).
  • Maks antall klynger: Maksimalt antall klynger som må holdes hydrert. Sett basert på forventede samtidige økter.
  • Idle timeout: Hvor lenge en ubrukt klynge blir tildelt før Fabric avslutter den.
Arbeidsbelastningstype Anbefalt størrelse Beskrivelse
Utforskende analyse 2-4 kjerner Lette arbeidsbelastninger, rask datautforskning
Medium beregning 8-12 kjerner Daglig rapportering, mellomstore datasett
Tung beregning 14–16 kjerner Store datasett, komplekse transformasjoner

Administrer bibliotekavhengigheter

  • Bruk miljøgruppering: Forhåndsinstaller felles biblioteker i miljøet i stedet for installasjon på farten.
  • Miljøversjonering: Oppdatering av et tilknyttet miljø krever republisering og oppdatering av hydrerte klynger.
  • Oppfrisk hydrerte klynger: Etter miljøendringer, oppdater bassenget eller vent til neste planlagte syklus for å gjøre endringer.

Tilpass deg arbeidsmengdemønstre

  • Overvåk uteoppførsel: Juster tomgangstider basert på faktiske bruksmønstre.
  • Del på tvers av økter: Vurder å dele det samme miljøet på tvers av flere pooler hvis du har konsistente arbeidsmengdemønstre for å forbedre ressursutnyttelsen.

Beste praksis for å planlegge

  • Samsvar med arbeidsmengdemønstre: Planlegg aktive tider når teamet ditt kjører interaktive eller planlagte notatbøker.
  • Buffertid: Start timeplanen 60-90 minutter før den første forventede notatboken for å la hydrering bli ferdig.
  • Verifiser tilgjengelighet: Før en planlagt kjøring med forsinkelsessensitivitet, bekreft at live poolen har minst én tilgjengelig klynge i overvåkingshuben.
  • Vurder tidssoner: Hvis laget ditt dekker flere tidssoner, utvid timeplanen til å dekke nødvendige tidsintervaller.

Feilsøking

Feilsøking av tilpassede live pools innebærer å sjekke poolstatus, miljøhelse og tidsplankonfigurasjon som beskrevet i følgende scenarioer:

Pool er fortsatt ikke tilgjengelig

Hvis poolen ikke aktiveres eller viser statusen "Ikke tilgjengelig":

  • Sjekk at Fabric-kapasiteten er aktiv og for øyeblikket tildelt arbeidsområdet
  • Sjekk at det tilknyttede miljøet er i en "Klar"-tilstand.
  • Sørg for at det tilknyttede miljøet er publisert og ikke har noen feil.

Hydrering tar lengre tid enn forventet

Hvis hydreringen er tregere enn forventet:

  • Sjekk miljøavhengigheter og byggestatus.
  • Sjekk at miljøet er i en "Klar"-tilstand.
  • Følg med på pool-detaljer for mer informasjon.

Økter eller notatbøker starter ikke

Hvis notatbokøkter ikke starter selv med en aktiv pool:

  • Sjekk at økten bruker riktig miljø.
  • Verifiser at bassenget er i "Tilgjengelig" status og fullt hydrert.

Live pool-innstillinger er ikke tilgjengelige

Hvis du ikke kan opprette eller oppdatere live pool-konfigurasjonen:

  • Verifiser at du har rollen som administrator eller medlem i arbeidsområdet.
  • Hvis du har Medlem-rollen , be en arbeidsområdeadministrator aktivere Tilpass beregningskonfigurasjon for elementer.
  • Verifiser at en arbeidsområdeadministrator har opprettet en egendefinert Spark-pool som du kan velge i miljøet.