Übersicht über die Konfiguration der SharePoint-Erfassung

Erfahren Sie mehr über die unterstützten Authentifizierungsmethoden für den verwalteten SharePoint Connector in Lakeflow Connect. Der verwaltete SharePoint Connector unterstützt die Aufnahme von unstrukturierten Dateien (z. B. PDFs und DOCX) sowie strukturierte Formate (z. B. CSV, JSON und Excel) in Delta-Tabellen. Informationen zu benutzerdefinierten Pipelines mit Spark- und SQL-APIs mit voller Kontrolle über die Analyse und Transformationen finden Sie unter "Aufnehmen von Dateien aus SharePoint".

Auswählen Ihres SharePoint-Connectors

Lakeflow Connect bietet zwei SharePoint Connectors. Beide greifen in SharePoint auf Daten zu, unterscheiden sich jedoch in ihrer Verwaltungsebene.

Connector Beschreibung
Verwalteter SharePoint Connector Ein vollständig verwalteter Steckverbinder. Einfacher, wartungsarmer Connector für Unternehmensanwendungen, der Daten in Delta-Tabellen erfasst und mit der Quelle synchronisiert.
Standard-SharePoint-Connector Erstellen Sie benutzerdefinierte Ingestionspipelines mit SQL, PySpark oder Lakeflow-Pipelines mithilfe von Batch- und Streaming-APIs wie read_files, spark.read, COPY INTO und Auto Loader. Bietet die Flexibilität, komplexe Transformationen während der Aufnahme durchzuführen, und bietet Ihnen eine größere Verantwortung für die Verwaltung und Wartung Ihrer Pipelines.

Tipp

Databricks empfiehlt den verwalteten SharePoint Connector für die meisten Anwendungsfälle.

Welche Authentifizierungsmethode sollte ich auswählen?

Der verwaltete SharePoint Connector unterstützt die folgenden Authentifizierungsmethoden:

Diese Methode erfordert keine Azure App-Registrierung. Databricks verwaltet die OAuth-Konfiguration und die Tokenaktualisierung automatisch. Die vollständigen Schritte zur Einrichtung finden Sie unter OAuth U2M konfigurieren: Databricks-verwaltet für die Datenaufnahme aus Microsoft SharePoint.