Aloituspoolien konfigurointi Microsoft Fabric -ohjelmassa

Aloituspoolit tarjoavat nopean Spark-istunnon käynnistyksen Fabricissa. Voit aloittaa Spark-työn nopeasti, sen sijaan että odottaisit täyttä klusterin provisionointia jokaisella kierroksella.

Aloituspoolit käyttävät keskitasoisia solmuja ja tukevat automaattista skaalausta työkuorman tarpeen mukaan. Oletus- ja maksimirajat riippuvat kankaan kapasiteetin SKU:sta.

Tärkeää

Aloituspoolit ovat Microsoft:n hallinnoimia, parhaalla mahdollisella optimoinnilla, joka lyhentää Sparkin käynnistysaikaa käyttämällä esilämmitettyä kapasiteettia. Aloituspoolin kapasiteetti ei ole taattu jokaisella kierroksella. Kun esilämmitetty kapasiteetti on käytettävissä, istunnot voivat yleensä alkaa sekunneissa. Kun näin ei ole, Fabric aloittaa session tavallisella tilauskapasiteetilla, mikä voi kestää kauemmin.

Vinkki

Työkuormille, jotka vaativat ennustettavaa, johdonmukaista istuntoaloitusta – kuten aikataulutetut Spark-tehtävämäärittelyt tai muut viiveherkät työt – käytä mukautettua live-poolia. Mukautetut live-poolit pitävät omat klusterit lämpiminä aikataululla, jota hallitset (aktiivinen ikkuna), joten sessiot alkavat säännöllisesti noin viidessä sekunnissa kyseisen ikkunan aikana. Koska klusterit on nesteytetty etukäteen, ympäristökirjastot asennetaan valmiiksi klusterille, mikä poistaa kirjaston personointiaikaa per istunto.

Ennakkovaatimukset

Aloituspoolin räätälöintiin tarvitset ylläpitäjän roolin työtilassa.

Ymmärrä aloituspoolin asetukset

Työtilan asetuksissa voit määrittää nämä aloituspoolin kontrollit:

  • Automaattinen skaalaus: Jos se on käytössä, Apache Spark -pooli skaalautuu automaattisesti ylös ja alas aktiivisuuden mukaan.
  • Dynaaminen suorittajien jakaminen: Jos se on käytössä, Spark jakaa ja vapauttaa suorittajat työkuorman tarpeen mukaan.

Molemmat vaihtoehdot ovat oletuksena käytössä. Käytä liukusäätimiä lisätäksesi tai vähentääksesi työkuorman määriteltyjä rajoja.

Määritä aloituspoolin asetukset

Voit hallita työtilaasi liittyvää aloitusvarantoa seuraavasti:

  1. Mene työtilaasi ja valitse Työtilan asetukset.

    Kuvakaappaus, jossa näkyy, missä Data Engineering valitaan työtilan asetuksista.

  2. Laajenna Data Engineering/Science vasemmasta ruudusta ja valitse sitten Spark settings.

    Kuvakaappaus, jossa näkyy aloituspoolin asetukset.

  3. Valitse StarterPoololetuksena olevasta työtilapoolin pudotusvalikosta nähdäksesi yleiskatsauksen aloituspoolin asetuksista.

  4. Valitse kynäkuvake Poolin yksityiskohdasta muokataksesi aloituspoolin asetuksia.

  5. Muokkausnäkymässä konfiguroi automaattinen skaalaus ja varaa suorittajat dynaamisesti.

    Käytä liukusäätimiä lisätäksesi tai vähentääksesi jokaista asetusta työkuorman tarpeidesi mukaan.

    Kuvakaappaus, jossa näkyy automaattinen skaalaus ja dynaaminen suorittajan asetusten jakaminen liukusäätimillä aloituspooleille.

    Voit säilyttää oletusarvot tai vähentää rajoja pienemmille työkuormille. Voit myös nostaa arvoja SKU:n sallimaan maksimiin.

  6. Kun olet tehnyt muutokset, valitse Tallenna ottaaksesi uudet asetukset aloituspoolille tai valitse Poista poistaaksesi muutokset. Muussa tapauksessa voit valita taaksepäin -nuolen poistuaksesi ilman, että tallennat tai hylkäät muutoksia.

Seuraava taulukko näyttää oletus- ja maksimialoituspoolin rajoitukset SKU:n mukaan.

SKU-nimi Kapasiteetin yksiköt Spark-näennäisytimet Solmun koko Solmujen oletusmuotoiset enimmäissolmut Solmujen enimmäismäärä
F2 2 4 Keskisuuri 1 1
F4 4 8 Keskisuuri 1 1
F8 8 16 Keskisuuri 2 2
F16 16 32 Keskisuuri 3 4
F32 32 64 Keskisuuri 8 8
F64 64 128 Keskisuuri 10 16
(Kokeiluversion kapasiteetti) 64 128 Keskisuuri 10 16
F128 128 256 Keskisuuri 10 32
F256 256 512 Keskisuuri 10 64
F512 512 1024 Keskisuuri 10 128
F1024 1024 2048 Keskisuuri 10 200
F2048 2048 4096 Keskisuuri 10 200
F4096 4096 8192 Keskisuuri 10 200
F8192 8192 16384 Keskisuuri 10 200