Begrænsninger i Microsoft Fabric-katalogspejling for Google Lakehouse runtime-katalog

Denne artikel oplister aktuelle begrænsninger og overvejelser ved Google Lakehouse runtime katalogspejling i Microsoft Fabric.

Vigtigt!

Denne funktion er i prøveversion.

Begrænsninger og overvejelser

  • Du kan kun spejle Apache Iceberg V2-tabeller. Google Lakehouse runtime-katalog understøtter ikke Iceberg V1-tabeller.
  • Google Lakehouse Apache Iceberg REST-katalogets endpoint understøtter kun Parquet-datafiler.
  • Fabric konverterer automatisk tabeller, du spejler fra Google Lakehouse runtime-katalog, fra Iceberg til Delta Lake. Denne konvertering er underlagt begrænsningerne ved Iceberg til Delta Lake-konverteringsfunktionen.
  • Fabric får adgang til Apache Iceberg REST-katalogets endpoint og Google Cloud Storage-placeringen af alle spejlede tabeller via det offentlige internet. Katalog-spejling understøtter i øjeblikket ikke firewall-regler eller andre netværksbegrænsninger. Microsoft planlægger at rette op på denne begrænsning.
  • Du kan spejle op til 500 borde på én gang. Denne grænse gælder både for individuelt udvalgte tabeller og tabeller, der automatisk spejles.
  • Google Lakehouse Apache Iceberg REST-katalogets endpoint begrænser hver Iceberg-fil metadata.json til 1 MB.
  • Spejlede Google Lakehouse runtime-katalogdata er skrivebeskyttet i Fabric. Du kan ikke skrive tilbage til kildetabellerne via det spejlede element.
  • Fintdetaljerede adgangstilladelser, som du definerer i Google Cloud, såsom sikkerhed på række- og søjleniveau, håndhæves ikke på det spejlede element i Fabric. Giv adgang til det spejlede element gennem OneLake-sikkerheden, og gennemgå det spejlede element som dets egen adgangsflade.
  • Du skal have Workload Identity Pool og OIDC-udbyderen aktiveret. Deaktivering af enten ressource, sletning af udbyderen, fjernelse af en IAM-binding eller tilbagekaldelse af BigLake Viewer eller Service Usage Consumer-rollen forhindrer Fabric i at få adgang til kataloget.
  • OIDC-udbyderens udsteder og tilladte målgruppe skal nøjagtigt matche Microsoft Entra-tokenkravene. Udstederen skal inkludere den efterfølgende skråstreg i https://sts.windows.net/{TENANT_ID}/, og det tilladte publikum skal være https://analysis.windows.net/powerbi/connector/MirroredGoogleLakehouseRuntimeCatalog.
  • Den krævede attributmapping er google.subject = assertion.oid. Hvis du sletter og genskaber en autoriseret Microsoft Entra-identitet, ændres dens objekt-ID, og du skal tilføje en ny Google Cloud IAM principal-binding.
  • Et pool-dækkende principalSet wildcard tildeler sine roller til enhver identitet, der med succes føderer gennem Workload Identity Pool, potentielt inklusive identiteter fra flere udbydere. Brug individuelle subjektbindinger eller et smallere attributbaseret principal-sæt, når det er muligt.
  • Google Lakehouse runtime-katalog understøtter ikke database-, metastore- og Apache Iceberg-visninger. Disse visninger er ikke tilgængelige i det spejlede element.

For Google Cloud-servicebegrænsninger, der også gælder for kildekataloget, se Lakehouse runtime catalog limitations og Apache Iceberg REST catalog endpoint limitations.