Merk
Tilgang til denne siden krever autorisasjon. Du kan prøve å logge på eller endre kataloger.
Tilgang til denne siden krever autorisasjon. Du kan prøve å endre kataloger.
Du kan opprette en logisk kopi av KQL-databasedata i et hendelseshus ved å slå på OneLake-tilgjengelighet. Når du slår på OneLake-tilgjengelighet, kan du spørre dataene i KQL-databasen din i Delta Lake-format via andre Fabric-motorer som Direct Lake-modus i Power BI, Warehouse, Lakehouse, Notebooks og flere. Delta Lake er det enhetlige datalake-tabellformatet som gjør sømløs datatilgang mulig på tvers av alle beregningsmotorer i Fabric.
I denne artikkelen lærer du hvordan du slår på tilgjengeligheten av KQL-databasedata i OneLake.
Når OneLake-tilgjengelighet og skjema-synkronisering er aktivert, kan du også bruke Analyze data med>SQL-endepunkt på databasenivå for å spørre Delta Lake-representasjonen i nesten sanntid via SQL-baserte motorer.
Når OneLake-tilgjengelighet og skjema-synkronisering er aktivert, kan du også bruke Analyze data med>SQL-endepunkt på databasenivå for å spørre Delta Lake-representasjonen i nesten sanntid via SQL-baserte motorer.
Hvordan OneLake-tilgjengelighet fungerer for KQL-databaser
Du kan aktivere OneLake-tilgjengelighet på database- eller tabellnivå. Når de aktiveres på databasenivå, gjøres alle nye tabeller og deres data tilgjengelige i OneLake. Når du aktiverer funksjonen, kan du også velge å bruke dette alternativet på eksisterende tabeller ved å velge alternativet Bruk på eksisterende tabeller, for å inkludere historisk etterfylling. Hvis du aktiverer på tabellnivå, blir bare tabellen og dataene tilgjengelige i OneLake. Policyen for dataoppbevaring av KQL-databasen, brukes også på dataene i OneLake. Data som fjernes fra KQL-databasen på slutten av oppbevaringsperioden, fjernes også fra OneLake. Hvis du deaktiverer OneLake-tilgjengelighet, slettes data fra OneLake.
Backend-skjemasynkronisering holder Delta Lake-representasjonen i samsvar med KQL-databasen, noe som muliggjør nær-sanntids forespørsler gjennom SQL-endepunktet og notatbøker. For forventet latens og batching-atferd, se Adaptiv atferd.
Selv om OneLake-tilgjengelighet er aktivert, kan du ikke gjøre følgende oppgaver:
- Gi tabellene nytt navn.
- Endre en kolonnetype. Å legge til eller slette en kolonne støttes.
- Bruk rad-nivå sikkerhet på tabeller.
- Slett, forkort eller fjern data.
Hvis du trenger å gjøre noen av disse oppgavene, kan du bruke følgende fremgangsmåte:
- Slå av OneLake-tilgjengelighet.
- Utfør oppgaven.
- Slå på OneLake-tilgjengelighet.
Viktig
Hvis du slår av OneLake-tilgjengelighet slettes dataene fra OneLake. Når du slår på tilgjengeligheten igjen, er all data tilgjengelig i OneLake, inkludert historisk fyll.
Merk
For informasjon om hvor lang tid det tar før data vises i OneLake, se Adaptiv atferd. Det er ingen ekstra lagringskostnader å slå på OneLake-tilgjengelighet. Hvis du vil ha mer informasjon, kan du se ressursforbruket.
Forutsetning
- En workspace med en Fabric-aktivert capacity.
- En KQL-database med redigeringstillatelser og data.
Slå på OneLake-tilgjengelighet for en KQL-database eller tabell
Du kan slå på OneLake-tilgjengelighet for enten en KQL-database eller tabell.
Velg en database eller tabell.
Angi TilgjengelighetAktiverti delen OneLake i detaljruten.
I vinduet Aktiver OneLake tilgjengelighet , velg Aktiver.
Databasen eller tabelldetaljene oppdateres automatisk.
Når du slår på OneLake-tilgjengelighet i KQL-databasen eller tabellen din, kan du få tilgang til all data på den gitte OneLake-ruten i Delta Lake-format. Du kan også lage en OneLake-snarvei fra et innsjøhus eller lager, eller spørre dataene direkte via Power BI Direct Lake-modus. Med OneLake-tilgjengelighet i KQL-databasen eller tabellen aktivert, kan du nå få tilgang til alle dataene på den angitte OneLake-banen i Delta Lake-format. Du kan også opprette en OneLake-snarvei fra et Lakehouse, datalager eller spørre dataene direkte via Power BI Direct Lake-modus.
Bruk med Analyser data med alternativer
Når OneLake-tilgjengelighet er aktivert, eksponerer Eventhouse- og KQL-databaseelementer Analyse-data med alternativer på databasenivå:
- SQL-endepunkt: Tilgjengelig når både OneLake-tilgjengelighet og skjema-synkronisering er aktivert.
- Notatbok: Åpner notatbokbasert analyse for den valgte databasen.
Hvis du slår av tilgjengeligheten av OneLake, fjernes SQL-endepunktsalternativet fra denne menyen til du aktiverer det igjen.
Adaptiv atferd for parquet-filbatching
Et eventhouse samler intelligent innkommende datastrømmer i én eller flere Parquet-filer strukturert for analyse. Batching av datastrømmer er viktig når man håndterer dryppende data, fordi det kan være ineffektivt å skrive mange små Parquet-filer i innsjøen. Denne ineffektiviteten resulterer i høyere kostnader og dårlig søkeytelse.
Eventhouse-adaptivmekanismen kan forsinke skriveoperasjoner til OneLake hvis det ikke er nok data til å lage optimale Parquet-filer. Denne oppførselen sikrer at Parquet-filene er optimale i størrelse og følger beste praksis i Delta Lake. Den balanserer behovet for rask datatilgjengelighet med kostnads- og ytelseshensyn.
Standard og konfigurerbar skriveforsinkelse for tilgjengelighet av OneLake:
| Innstilling | Standardverdi | Tillatt område |
|---|---|---|
Forsinkelse for skriveoperasjoner (TargetLatencyInMinutes) |
Opptil 3 timer, eller inntil filer av tilstrekkelig størrelse (vanligvis 200-256 MB) er opprettet | 5 minutter til 3 timer |
For eksempel, bruk følgende Kusto-kommando for å sette skriveforsinkelsen til 5 minutter for en enkelt tabell:
.alter-merge table <TableName> policy mirroring dataformat=parquet with (IsEnabled=true, TargetLatencyInMinutes=5);
Forsiktig!
Hvis du justerer forsinkelsen til en kortere periode, kan det føre til en deloptimal deltatabell med et stort antall små filer, noe som kan føre til ineffektiv spørringsytelse. Den resulterende tabellen i OneLake er skrivebeskyttet og kan ikke optimaliseres etter oppretting.
Du kan overvåke hvor lenge det er siden nye data ble lagt til i innsjøen ved å sjekke dataforsinkelsen med kommandoen.show table mirroring operations.
Resultatene måles fra forrige gang data ble lagt til. Når latens returnerer 00:00:00, er all data i KQL-databasen tilgjengelig i OneLake.
Se Delta Lake-filer i OneLake
Når du slår på OneLake-tilgjengelighet i en tabell, oppretter prosessen en delta-loggmappe sammen med eventuelle tilsvarende JSON- og Parquet-filer. Du kan se filene som er tilgjengelige i OneLake og deres egenskaper mens du holder deg innenfor Real-Time Intelligence.
Hvis du vil vise filene, holder du pekeren over en tabell i Explorer-ruten og velger deretter Mer-menyen [...]>Vis filer.
Hvis du vil vise egenskapene for deltaloggmappen eller de individuelle filene, holder du pekeren over mappen eller filen og velger deretter Mer-menyen [...]>Egenskaper.
Slik viser du filene i deltaloggmappen:
- Velg mappen _delta_log.
- Velg en fil for å vise tabellmetadataene og -skjemaet. Redigeringsprogrammet som åpnes, er i skrivebeskyttet format.
Få tilgang til OneLake-speilingspolicyen
Som standard, når du slår på OneLake-tilgjengelighet for en KQL-database eller tabell, aktiverer systemet en speilingspolicy. Du kan bruke speilingspolicyen for å overvåke datalatens eller endre den for å partisjonere deltatabeller.
Merk
Hvis du deaktiverer OneLake-tilgjengelighet, er speilingspolicyens IsEnabled egenskap satt til usann (IsEnabled=false).
Partisjonsdeltatabeller i OneLake
Du kan partisjonere deltatabellene for å forbedre spørringshastigheten. Hvis du vil ha informasjon om når du skal partisjonere OneLake-filer, kan du se Når du skal partisjonere tabeller. Hver partisjon representeres som en egen kolonne ved å bruke de PartitionName som er listet i Partitions listen. Denne representasjonen betyr at OneLake-kopien din har flere kolonner enn kildetabellen din.
For å partisjonere delta-tabellene dine, bruk kommandoen .alter-merge table policy mirroring .
Søk i Delta-tabeller fra en Fabric-notatbok
Du kan bruke Fabric Notebook til å lese OneLake-dataene ved hjelp av kodesnutten nedenfor.
Tips
Du kan starte en ny eller eksisterende Fabric-notebook direkte fra Analyze data with>Notebook på en Eventhouse- eller KQL-database. Notatboken festes automatisk til den valgte databasekonteksten. Bruk følgende kodeeksempel når du ønsker manuell stibasert tilgang.
I kodesnutten erstatter du
<workspaceGuid>,<workspaceGuid>og<tableName>med dine egne verdier.
delta_table_path = 'abfss://<workspaceGuid>@onelake.dfs.fabric.microsoft.com/<eventhouseGuid>/Tables/<tableName>'
df = spark.read.format("delta").load(delta_table_path)
df.show()
Merk
Bruk denne koden for en Azure Data Explorer-database:
delta_table_path = 'abfss://<workspaceName>@onelake.dfs.fabric.microsoft.com/<itemName>.KustoDatabase/Tables/<tableName>'