In dit artikel vindt u antwoorden op veelgestelde vragen over Mirroring Snowflake in Microsoft Fabric.
Functies en mogelijkheden
Is er een faserings- of landingszone voor Snowflake? Zo ja, is het buiten OneLake?
Voor Snowflake gebruiken we een landingszone om zowel de momentopname op te slaan als gegevens te wijzigen in OneLake, om de prestaties te verbeteren wanneer we deze bestanden in de landingszones converteren naar deltavertiparquet.
Welke Snowflake-objecttypen kunnen worden gerepliceerd?
Beheerde tabellen, Iceberg-tabellen en weergaven worden ondersteund voor replicatie. Externe, tijdelijke, tijdelijke en dynamische tabellen worden niet ondersteund. Voor Iceberg-tabellen is een opslagverbinding met de onderliggende Iceberg-tabelopslag vereist tijdens de configuratie. Zie Beperkingen voor meer informatie over bekende problemen met weergaven (zoals toewijzing van gegevenstypen).
Hoe beheer ik verbindingen?
Selecteer het tandwielpictogram Instellingen en selecteer vervolgens Verbinding en gateways beheren. U kunt ook bestaande verbindingen van deze pagina verwijderen.
Welke verificatiemethoden worden ondersteund voor Snowflake-spiegeling?
De volgende authenticatiemethoden worden ondersteund:
- Gebruikersnaam en wachtwoord : systeemeigen Snowflake-verificatie
- Microsoft Entra ID (SSO) — Eenmalige aanmelding via Entra ID
- Verificatie van sleutelpaar - RSA-sleutelpaar voor serviceaccountscenario's
Kostenefficiëntie
Hoe kan ik de rekenkosten van Snowflake verminderen door spiegeling te gebruiken?
- Een bestaand magazijn opnieuw gebruiken. Configureer spiegeling om hetzelfde Snowflake-magazijn te gebruiken dat uw toepassingen al gebruiken om de brontabellen bij te werken. Dit voorkomt de overhead van het activeren van een afzonderlijk warehouse voor mirroring. Wanneer uw toepassing een tabel bijwerkt, detecteert de replicator voor mirroring de wijzigingen vrijwel onmiddellijk terwijl het datawarehouse nog actief is. 2. Alleen de tabellen spiegelen die u nodig hebt. Vermijd spiegeling van een hele database wanneer u alleen een subset van tabellen nodig hebt. Grootschalige mirroring kan leiden tot aanzienlijk Snowflake-verbruik en pieken in de Fabric-capaciteit. 3. Controleer op onverwachte reseeds. Een reseed leest de volledige tabel opnieuw en brengt rekenkosten met zich mee die evenredig zijn aan de grootte ervan. Controleer de pagina Status van spiegeling voor tabellen die herhaaldelijk het gedrag van de eerste kopie weergeven. 4. Gebruik Snowflake-budgetten en kredietlimieten. Stel Snowflake-resourcemonitors en budgetten in om aan mirroring gerelateerde computekosten te begrenzen.
Hoe worden ingresskosten verwerkt?
Fabric brengt geen kosten in rekening voor inkomende gegevens naar OneLake voor Mirroring.
Hoe worden kosten voor uitgaand verkeer verwerkt?
Als ze buiten Azure worden gehost, raadpleeg dan de documentatie van Snowflake en uw cloudprovider voor kosten voor uitgaand gegevensverkeer. Als gegevens worden gehost in Azure maar in een andere regio dan uw Fabric-capaciteit, worden er kosten in rekening gebracht voor uitgaande gegevens. Als deze worden gehost in Azure in dezelfde regio, zijn er geen uitgaande gegevens.
Ondersteunt spiegeling plannings- of replicatievensters?
Nee. Spiegeling wordt continu uitgevoerd en biedt momenteel geen ondersteuning voor het configureren van replicatieschema's of tijdgebaseerde vensters. De replicator peilt voortdurend naar wijzigingen, waardoor continu rekengebruik van Snowflake wordt gegenereerd. Als u de berekening gedurende bepaalde perioden wilt beperken, kunt u spiegeling handmatig stoppen en opnieuw opstarten, maar houd er rekening mee dat het opnieuw opstarten een volledige weergave van alle gespiegelde tabellen activeert.
Performance
Hoe lang duurt de initiële replicatie?
Dit hangt af van de grootte van de gegevens die worden binnengebracht.
Hoe lang duurt het om invoegingen/updates/verwijderingen te repliceren?
Nagenoeg realtimelatentie.
Maken de Power BI-rapporten gebruik van de direct lake-modus?
Ja, tabellen zijn alle v-geordende deltatabellen.
Problemen met Mirroring Snowflake in Microsoft Fabric oplossen
Wat zijn de replicatiestatussen?
Kan Snowflake Mirroring worden geopend via de Power BI-gateway of achter een firewall?
Ja, ondersteunen we spiegeling via een on-premises gegevensgateway en via een Virtual Network (VNet)-gegevensgateway.
Wat doet het starten van het spiegelen?
De gegevens uit brontabellen worden opnieuw geïnitialiseerd. Telkens wanneer u stopt en start, wordt de hele tabel opnieuw opgehaald.
Wat gebeurt er als ik de selectie van een tabel van Spiegeling ongedaan maak?
We stoppen met Mirroring van die specifieke tabel en verwijderen deze uit OneLake.
Als ik de mirror verwijder, heeft dit invloed op de gespiegelde brondatabase?
Nee, we verwijderen alleen de streamingtabellen.
Kan ik dezelfde database meerdere keren spiegelen?
Ja, dat kan, maar dat hoeft u niet te doen. Zodra de gegevens zich in Fabric bevinden, kunnen ze daar worden gedeeld.
Kan ik specifieke tabellen spiegelen vanuit mijn brondatabase?
Ja, tijdens de configuratie van spiegeling kunnen specifieke tabellen worden geselecteerd.
Wat veroorzaakt een volledige herinitialisatie?
Een reseed (volledig opnieuw laden van gegevens) wordt geactiveerd door een van de volgende opties:
- DDL-wijzigingen die de DDL-tijdstempel van een tabel wijzigen, bijvoorbeeld
ALTER TABLEbewerkingen waarmee kolommen worden toegevoegd of verwijderd. - Hulpprogramma's voor schemawijziging, zoals dbt die tabellen in een schema verwijderen en opnieuw maken.
- Spiegeling stoppen en opnieuw starten via het Fabric-portaal of de API.
- Een langdurige capaciteitsonderbreking. Als de Fabric-capaciteit lange tijd is gepauzeerd, moet mirroring mogelijk opnieuw worden geseed wanneer de capaciteit wordt hervat.
Hoe kan ik problemen met onverwacht of doorlopend opnieuw verzenden oplossen?
Als u ziet dat tabellen herhaaldelijk een initiële kopie (reseed) ondergaan in plaats van een incrementele synchronisatie:
- Controleer op wijzigingen in het bovenliggende schema. Controleer of een hulpprogramma zoals dbt tabeldefinities volgens een terugkerend schema wijzigt. Zelfs kleine DDL-wijzigingen kunnen een reseed veroorzaken.
- Bekijk de pagina Spiegelstatus. Zoek naar tabellen met herhaalde tijdstempels voor eerste kopieerbewerkingen met regelmatige tussenpozen.
- Schemawijzigingen onderbreken tijdens actieve spiegeling. Als dbt-runs de oorzaak zijn, plan deze dan tijdens onderhoudsvensters of pauzeer de mirroring voordat u schemawijzigingen uitvoert.
- Bewaak het gebruik van Snowflake-magazijnen. Controleer de accountgebruiksweergaven van Snowflake om te zien of query’s met betrekking tot mirroring het rekenverbruik domineren.
- Houd er rekening mee dat elke reseed-actie de volledige tabeldata verwerkt en Snowflake-computekosten met zich meebrengt die evenredig zijn aan de tabelgrootte. evenredig met de tabelgrootte.
Gegevensbeheer
Verlaten gegevens ooit de Fabric-tenant van klanten?
Nee.
Worden gegevens buiten de omgeving van de klant opgeslagen?
Nee, gegevens worden niet buiten de omgeving van de klant tijdelijk opgeslagen, maar in de OneLake-omgeving van de klant.
Licensing
Wat zijn licentieopties voor Fabric Mirroring?
Een Power BI Premium-, Fabric-capaciteit of proefversiecapaciteit is vereist. Zie Microsoft Fabric-licenties voor meer informatie over licenties.
Wat zijn de Fabric-rekenkosten die gepaard gaan met Mirroring?
Fabric-rekenkracht die wordt gebruikt om uw gegevens te repliceren naar Fabric OneLake is gratis. De kosten voor spiegelopslag zijn gratis tot een bepaalde limiet, afhankelijk van de capaciteit. Zie Kosten voor spiegeling en Prijzen van Microsoft Fabric voor meer informatie. De berekening voor het uitvoeren van query's op gegevens met behulp van SQL, Power BI of Spark wordt regelmatig in rekening gebracht.