Konfigurera anpassade livepooler i Microsoft Fabric

Gäller för:✅ Fabric datateknik och datavetenskap

Specialanpassade livepooler är förhydrerade Spark-kluster som ger nästan omedelbar sessionstart för anteckningsböcker i Fabric. Den här artikeln visar hur du skapar, konfigurerar och hanterar anpassade livepooler för optimala prestanda.

Förutsättningar

Kontrollera att du har följande innan du konfigurerar anpassade livepooler:

  • Tillgång till en Fabric-arbetsyta med en betald Fabric-SKU (Fabric-testkapaciteter stöds inte).
  • Administratörs - eller medlemsroll i arbetsområdet.
  • En aktiv Fabric-kapacitet som har tilldelats till din arbetsyta.
  • En publicerad Fabricmiljö som ska användas för bibliotekskonfiguration.
  • En befintlig anpassad Spark-pool. Endast workspace-administratörer kan skapa egna Spark-pooler.

Om du har rollen Medlem måste en administratör för arbetsytan aktivera den befintliga arbetsyteinställningen Anpassa beräkningskonfiguration för objekt.

Viktigt!

Startpooler stöds inte för skräddarsydda livepooler. Om din arbetsyta använder en startpool måste du skapa en anpassad Spark-pool innan du konfigurerar en anpassad livepool.

Använd den befintliga inställningen för beräkningsanpassning

Anpassade live-pooler använder den befintliga arbetsyteinställningen Anpassa beräkningskonfiguration för objekt. De har ingen separat delegeringsinställning. Innan en arbetsytemedlem kan skapa eller uppdatera en anpassad live pool-konfiguration måste en arbetsytsadministratör aktivera den befintliga inställningen:

  1. Gå till din Fabric-arbetsyta.

  2. Välj Inställningar för arbetsyta i arbetsytans startfliksområde.

  3. Expandera Datateknik/Vetenskap och välj Spark-inställningar.

  4. Välj fliken Pool .

  5. Slå på Anpassa konfiguration för beräkning för objekt.

    Skärmdump som visar switchen för att anpassa beräkningskonfigurationen för objekt.

  6. Välj Spara.

När denna inställning är aktiverad kan medlemmar använda en Fabric-miljö för att välja en befintlig anpassad Spark-pool, justera sessionsnivå-drivrutinskärnor, drivrutinsminne, exekutörerkärnor och exekutörerminne, samt skapa eller uppdatera live pool-konfigurationen. Medlemmar kan sedan spara och publicera miljön.

Denna inställning tillåter inte medlemmar att skapa eller hantera anpassade Spark-pooler i arbetsytsinställningar. En workspace-administratör måste skapa den underliggande anpassade Spark-poolen.

När Anpassa beräkningskonfiguration för objekt är avstängt använder miljöerna arbetsytans standardpool och dess beräkningskonfiguration. Medlemmar kan inte skapa eller uppdatera en anpassad live pool-konfiguration förrän en workspace-administratör aktiverar inställningen.

För mer information om denna arbetsytskontroll, se Data Engineering workspace administration settings.

Skapa en anpassad pool för live poolen (endast administratör)

Den här uppgiften kräver arbetsyterollen Admin. Om en anpassad Spark-pool redan finns kan workspace-medlemmar hoppa över denna uppgift och konfigurera live pool-beräkning på den befintliga poolen.

  1. Gå till din Fabric-arbetsyta.
  2. Välj Inställningar för arbetsyta i arbetsytans startfliksområde.
  3. Expandera Datateknik/Vetenskap och välj Spark-inställningar.
  4. Välj fliken Pool .
  5. I listrutan Standardpool för arbetsyta väljer du Ny pool.
  6. Ange ett namn för poolen. Det här namnet är en unik identifierare för poolen, till exempel dev-team-pool eller prod-daily-analytics.
  7. Välj en Nod-familj och Nodstorlek för din arbetsbelastning.
  8. Markera kryssrutan Autoskalning för att aktivera automatisk skalning för poolen.

Konfigurera en livepool

Workspace-administratörer och medlemmar kan skapa eller uppdatera en live pool-konfiguration via miljöinställningarna . För medlemmar måste en arbetsytadministratör först aktivera Anpassa beräkningskonfiguration för objekt. Medlemmar måste välja en befintlig anpassad Spark-pool skapad av en arbetsplatsadministratör.

  1. Öppna den miljö som du vill koppla till en anpassad livepool i Fabric-arbetsytan.

  2. I den vänstra rutan väljer du Beräkning.

  3. Välj den pool som du skapade i föregående steg i listrutan.

  4. Under Live pool väljer du radioknappen för att aktivera livepool-beräkning för den här miljön.

    Skärmbild som visar knappen Live pool radio aktiverad i miljöns beräkningsinställningar.

  5. Under Live pool-schema väljer du kryssrutan för att slå på den. Alla anpassade livepooler måste ha ett schema. Kluster hålls endast hydratiserade under den schemalagda tidsramen.

  6. Ange schemainställningarna:

    • Om schemat är återkommande
    • Start- och slutdag och tid
    • Tidszon
    • När du ska inaktivera och återaktivera poolen
    • Andra inställningar i tillämpliga fall

    Viktigt!

    Fabric använder Standard Spark-etablering för aktivitet utanför det schemalagda fönstret, vilket har långsammare starttider. Kluster hålls inte varma utanför det schemalagda fönstret.

    Schemaläggningstips finns i Schemalägg metodtips.

  7. Spara beräkningsinställningarna.

  8. Välj knappen Publicera i det övre menyfliksområdet.

När du har publicerat är poolen aktiv och Fabric börjar förbereda kluster inför nästa schemaperiod.

Anmärkning

Det kan ta flera minuter att publicera.

Alla ändringar i miljön kräver ompublicering av miljön och uppdatering av hydratiserade kluster.

Förstå schemafönstret

Schemat definierar det tidsfönster då Fabric håller kluster aktiva och kan återaktivera kluster som den har avaktiverat. Den håller inte live-poolen uppvärmd utanför det konfigurerade tidsfönstret.

Till exempel, tänk på ett återkommande schema som går varje dag från kl. 08:00 till 17:00:

  • Klockan 08:00 inleds det dagliga schemafönstret och Fabric påbörjar eller fortsätter hydreringen.
  • Under schemaperioden kan ett inaktivt kluster avaktiveras efter den konfigurerade tidsgränsen för inaktivitet. Fabric kan återfukta en ersättning enligt det konfigurerade reaktiveringsintervallet.
  • Klockan 17:00 slutar schemat. Fabric fortsätter inte att återfukta kluster mellan kl. 17:00 och 08:00 nästa dag.
  • En notebook som skickas in utanför det schemalagda tidsfönstret använder standard-Spark-provisionering och får inte fördelen med varmstart från livepoolen.
  • Samma dagliga beteende upprepas fram till det konfigurerade schemats slutdatum.

Den schemalagda starttiden garanterar inte att ett kluster redan är tillgängligt vid exakt den tiden. Hydrering tar tid, särskilt efter en miljöuppdatering eller när Fabric måste provisionera ett nytt kluster. Om en schemalagd anteckningsbok måste börja kl. 08:00, starta live pool-schemat 60–90 minuter tidigare. Innan du kör anteckningsboken använder du Övervakningshubben för att bekräfta att Tillgängliga kluster är större än noll. En inkommande notebook får en varm session endast när ett kompatibelt hydratiserat kluster finns tillgängligt.

Övervaka poolstatus

Så här kontrollerar du statusen för din anpassade livepool:

  1. Öppna övervakningshubben i Infrastrukturportalen.

  2. Leta upp den miljö som du publicerade och välj ellipsen (...) för att öppna snabbmenyn.

  3. Välj Visa information.

    Skärmbild som visar status för livepoolen i övervakningshubben.

  4. I den högra rutan expanderar du Status för livepool för att visa poolens aktuella tillstånd.

Status för livepoolen innehåller information som:

  • Poolstatus: Till exempel Aktiv, Hydrating, Inaktiv eller Stoppad
  • Tillgängliga kluster: Antal kluster som är redo för notebook-sessioner
  • Upptagna kluster: Antal kluster som för närvarande kör sessioner
  • Nästa schema: Kommande aktivitetsfönster

Metodtips

Om du vill få ut mesta möjliga av anpassade livepooler bör du överväga följande metodtips för konfiguration och hantering:

Optimera för kostnad och prestanda

  • Justera antalet med efterfrågan: Ange det maximala antalet kluster baserat på förväntade samtidiga sessioner. Överprovisionering ökar kostnaderna.
  • Övervaka användning: Granska regelbundet poolmått och justera antalet kluster om det behövs.
  • Skala scheman effektivt: Undvik överlappande scheman över flera pooler om det inte behövs.
  • Utnyttja tidsgränsen för inaktivitet: Ange lämpliga tidsgränser för inaktivitet för att upprätthålla en balans mellan resurstillgänglighet och undvika frekventa omstarter av kluster.

Klusterstorlek

När du konfigurerar poolen bör du tänka på följande inställningar och rekommendationer:

  • Klusterstorlek: Antalet körinstanser för notebook-sessioner (intervall: 1–16).
  • Maximalt antal kluster: Det maximala antalet kluster som ska hållas hydratiserade. Ange baserat på förväntade samtidiga sessioner.
  • Tidsgräns för inaktivitet: Hur länge ett oanvänt kluster förblir allokerat innan Fabric avslutar det.
Typ av arbetsbelastning Rekommenderad storlek Beskrivning
Undersökande analys 2–4 kärnor Lätta arbetsbelastningar, snabb datautforskning
Medelstor beräkning 8–12 kärnor Daglig rapportering, medelstora datamängder
Tung beräkning 14–16 kärnor Stora datamängder, komplexa transformeringar

Hantera biblioteksberoenden

  • Använd miljögruppering: Installera vanliga bibliotek i miljön i förväg i stället för att installera direkt.
  • Miljöversionshantering: Uppdatering av en ansluten miljö kräver ompublicering och uppdatering av hydratiserade kluster.
  • Uppdatera hydratiserade kluster: När miljön har ändrats uppdaterar du poolen eller väntar på att nästa schemalagda cykel ska tillämpa ändringarna.

Anpassa till arbetsbelastningsmönster

  • Övervaka beteende utifrån: Justera tidsgränser för inaktivitet baserat på faktiska användningsmönster.
  • Dela mellan sessioner: Överväg att dela samma miljö i flera pooler om du har konsekventa arbetsbelastningsmönster för att förbättra resursanvändningen.

Schemalägg metodtips

  • Anpassa efter arbetsbelastningsmönster: Schemalägg aktiva tider när ditt team kör interaktiva eller schemalagda anteckningsböcker.
  • Bufferttid: Starta schemat 60–90 minuter före den första förväntade anteckningsboken för att låta vätskningen bli klar.
  • Verifiera tillgänglighet: Innan en schemalagd körning med känslig latens, kontrollera att livepoolen har minst ett tillgängligt kluster i övervakningshubben.
  • Överväg tidszoner: Om ditt team sträcker sig över flera tidszoner utökar du schemat så att det täcker de tidsintervall som krävs.

Felsökning

Felsökning av anpassade livepooler omfattar kontroll av poolstatus, miljöhälsa och schemakonfiguration enligt beskrivningen i följande scenarier:

Poolen är inte tillgänglig

Om poolen inte kan aktiveras eller visar statusen "Inte tillgänglig":

  • Kontrollera att Fabric kapacitet är aktiv och för tillfället tilldelad till arbetsytan
  • Kontrollera att den anslutna miljön är i tillståndet "Klar".
  • Kontrollera att den bifogade miljön har publicerats och att det inte finns några fel.

Hydrering tar längre tid än förväntat

Om hydreringen är långsammare än förväntat:

  • Kontrollera miljöberoenden och byggstatus.
  • Kontrollera att miljön är i tillståndet "Klar".
  • Granska poolinformation för mer information.

Sessioner eller notebook-filer startar inte

Om notebook-sessioner inte kan starta trots en aktiv pool:

  • Kontrollera att sessionen använder rätt miljö.
  • Kontrollera att poolen har statusen "Tillgänglig" och helt hydratiserad.

Live pool-inställningar finns inte tillgängliga

Om du inte kan skapa eller uppdatera live pool-konfigurationen:

  • Verifiera att du har rollen som administratör eller medlem i arbetsområdet.
  • Om du har Medlem-rollen, be en workspace-administratör att aktivera Anpassa beräkningskonfiguration för objekt.
  • Verifiera att en workspace-administratör har skapat en anpassad Spark-pool som du kan välja i miljön.