Hinweis
Für den Zugriff auf diese Seite ist eine Autorisierung erforderlich. Sie können versuchen, sich anzumelden oder das Verzeichnis zu wechseln.
Für den Zugriff auf diese Seite ist eine Autorisierung erforderlich. Sie können versuchen, das Verzeichnis zu wechseln.
Gilt für:
Azure Data Factory
Azure Synapse Analytics
Tipp
Data Factory in Microsoft Fabric ist die nächste Generation von Azure Data Factory mit einer einfacheren Architektur, integrierter KI und neuen Features. Wenn Sie mit der Datenintegration noch nicht vertraut sind, beginnen Sie mit Fabric Data Factory. Vorhandene ADF-Workloads können auf Fabric aktualisiert werden, um auf neue Funktionen in der Datenwissenschaft, Echtzeitanalysen und Berichterstellung zuzugreifen.
In diesem Artikel wird beschrieben, wie Sie die Kopieraktivität in einer Azure Data Factory- oder Synapse Analytics-Pipeline verwenden, um Daten in Azure KI-Suche Index zu kopieren. Er baut auf dem Artikel zur Übersicht über die Kopieraktivität auf, der eine allgemeine Übersicht über die Kopieraktivität enthält.
Hinweis
Dieser Connector ist auch in Data Factory in Microsoft Fabric verfügbar. Informationen zu Fabric spezifischen Konfigurationen und Features finden Sie in der Dokumentation zu Fabric Azure KI-Suche Connector.
Unterstützte Funktionen
Dieser Azure KI-Suche Connector wird für die folgenden Funktionen unterstützt:
| Unterstützte Funktionen | Infrarot | Verwalteter privater Endpunkt |
|---|---|---|
| Kopieraktivität (-/Senke) | (1) (2) | ✓ |
(1) Azure Integrationslaufzeit (2) Selbst gehostete Integrationslaufzeit
Sie können Daten aus einem beliebigen unterstützten Quelldatenspeicher in einen Suchindex kopieren. Eine Liste der Datenspeicher, die als Quellen oder Senken für die Kopieraktivität unterstützt werden, finden Sie in der Tabelle Unterstützte Datenspeicher.
Erste Schritte
Zum Ausführen der Kopieraktivität mit einer Pipeline können Sie eines der folgenden Tools oder SDKs verwenden:
- Datenkopier-Werkzeug
- Azure Portal
- .NET SDK
- Python SDK
- Azure PowerShell
- REST-API
- Azure Resource Manager Vorlage
Erstellen eines verknüpften Diensts zum Azure KI-Suche mithilfe der Benutzeroberfläche
Führen Sie die folgenden Schritte aus, um einen verknüpften Dienst zu Azure KI-Suche in der benutzeroberfläche des Azure Portals zu erstellen.
Navigieren Sie in Ihrem Azure Data Factory- oder Synapse-Arbeitsbereich zur Registerkarte „Verwalten“, und wählen Sie „Verknüpfte Dienste“ und anschließend „Neu“ aus:
Suchen Sie nach "Suchen", und wählen Sie den Azure KI-Suche Connector aus.
Konfigurieren Sie die Dienstdetails, testen Sie die Verbindung, und erstellen Sie den neuen verknüpften Dienst.
Details zur Connector-Konfiguration
In den folgenden Abschnitten werden Details zu Eigenschaften bereitgestellt, die zum Definieren von Data Factory-Entitäten verwendet werden, die für Azure KI-Suche Connector spezifisch sind.
Eigenschaften des verknüpften Diensts
Die folgenden Eigenschaften werden für den verknüpften Azure KI-Suche-Dienst unterstützt:
| Eigenschaft | Beschreibung | Erforderlich |
|---|---|---|
| Typ | Die type-Eigenschaft muss auf AzureSearch festgelegt werden. | Ja |
| url | URL für den Suchdienst | Ja |
| Schlüssel | Administratorschlüssel für den Suchdienst Markieren Sie dieses Feld als SecureString, um es sicher zu speichern, oder verweisen Sie auf ein in Azure Key Vault gespeichertes Geheimnis. | Ja |
| connectVia | Die Integration Runtime wird verwendet, um eine Verbindung mit dem Datenspeicher herzustellen. Sie können Azure Integration Runtime oder selbst gehostete Integration Runtime verwenden (wenn sich Ihr Datenspeicher im privaten Netzwerk befindet). Wenn nicht angegeben, wird die Standard-Azure Integration Runtime verwendet. | Nein |
Wichtig
Beim Kopieren von Daten aus einem Clouddatenspeicher in den Suchindex müssen Sie in Azure KI-Suche über den verknüpften Dienst auf eine Azure Integration Runtime mit einer expliziten Region in connectVia verweisen. Legen Sie die Region fest, in der sich Ihr Suchdienst befindet. Weitere Informationen finden Sie unter Azure Integration Runtime.
Beispiel:
{
"name": "AzureSearchLinkedService",
"properties": {
"type": "AzureSearch",
"typeProperties": {
"url": "https://<service>.search.windows.net",
"key": {
"type": "SecureString",
"value": "<AdminKey>"
}
},
"connectVia": {
"referenceName": "<name of Integration Runtime>",
"type": "IntegrationRuntimeReference"
}
}
}
Dataset-Eigenschaften
Eine vollständige Liste mit den Abschnitten und Eigenschaften, die zum Definieren von Datasets zur Verfügung stehen, finden Sie im Artikel zu Datasets. Dieser Abschnitt enthält eine Liste von Eigenschaften, die von Azure KI-Suche Dataset unterstützt werden.
Zum Kopieren von Daten in Azure KI-Suche werden die folgenden Eigenschaften unterstützt:
| Eigenschaft | Beschreibung | Erforderlich |
|---|---|---|
| Typ | Die type-Eigenschaft des Datasets muss auf AzureSearchIndex festgelegt werden. | Ja |
| indexName | Name des Suchindex. Der Dienst erstellt den Index nicht. Der Index muss in Azure KI-Suche vorhanden sein. | Ja |
Beispiel:
{
"name": "AzureSearchIndexDataset",
"properties": {
"type": "AzureSearchIndex",
"typeProperties" : {
"indexName": "products"
},
"schema": [],
"linkedServiceName": {
"referenceName": "<Azure AI Search linked service name>",
"type": "LinkedServiceReference"
}
}
}
Eigenschaften der Kopieraktivität
Eine vollständige Liste mit den Abschnitten und Eigenschaften zum Definieren von Aktivitäten finden Sie im Artikel Pipelines. Dieser Abschnitt enthält eine Liste der Eigenschaften, die von Azure KI-Suche Quelle unterstützt werden.
Azure KISearch als Sink
Um Daten in Azure KI-Suche zu kopieren, legen Sie den Quelltyp in der Kopieraktivität auf AzureSearchIndexSink fest. Folgende Eigenschaften werden im Abschnitt sink der Kopieraktivität unterstützt:
| Eigenschaft | Beschreibung | Erforderlich |
|---|---|---|
| Typ | Die type-Eigenschaft der Quelle der Kopieraktivität muss auf AzureSearchIndexSink festgelegt werden. | Ja |
| Schreibverhalten | Gibt an, ob ein Dokument zusammengeführt oder ersetzt werden soll, wenn es bereits im Index vorhanden ist. Siehe Eigenschaft „WriteBehavior“. Zulässige Werte sind Merge (Standard) und Upload. |
Nein |
| writeBatchSize | Lädt Daten in den Suchindex hoch, wenn die Puffergröße writeBatchSize erreicht. Einzelheiten finden Sie unter Eigenschaft „WriteBatchSize“. Zulässige Werte sind ganze Zahlen von 1 bis 1.000 (Standardwert „1.000“). |
Nein |
| maximale gleichzeitige Verbindungen | Die Maximalanzahl gleichzeitiger Verbindungen mit dem Datenspeicher während der Aktivitätsausführung. Geben Sie diesen Wert nur an, wenn Sie die Anzahl der gleichzeitigen Verbindungen begrenzen möchten. | Nein |
WriteBehavior-Eigenschaft
AzureSearchSink fügt Daten ein/aktualisiert beim Schreiben von Daten. Dies bedeutet, dass Azure KI Search beim Schreiben eines Dokuments das bestehende Dokument aktualisiert, anstatt eine Konfliktausnahme auszulösen, wenn der Dokumentenschlüssel bereits im Suchindex vorhanden ist.
Der AzureSearchSink bietet die folgenden zwei Upsert-Verhaltensweisen (mithilfe des AzureSearch SDK):
- Merge (Zusammenführen): kombiniert alle Spalten im neuen Dokument mit dem bestehenden. Bei Spalten mit Null-Wert im neuen Dokument wird der Wert im bestehenden Dokument beibehalten.
- Upload (Hochladen): Das neue Dokument ersetzt das bestehende. Für Spalten, die im neuen Dokument nicht angegeben sind, wird der Wert auf NULL festgelegt, ob im vorhandenen Dokument ein Wert ungleich NULL vorhanden ist oder nicht.
Das Standardverhalten ist Merge.
Eigenschaft „writeBatchSize“
Azure KI-Suche-Dienst unterstützt das Schreiben von Dokumenten als Batch. Ein Batch kann 1 bis 1.000 Aktionen enthalten. Eine Aktion bearbeitet ein Dokument, um den Vorgang upload/merge auszuführen.
Beispiel:
"activities":[
{
"name": "CopyToAzureSearch",
"type": "Copy",
"inputs": [
{
"referenceName": "<input dataset name>",
"type": "DatasetReference"
}
],
"outputs": [
{
"referenceName": "<Azure AI Search output dataset name>",
"type": "DatasetReference"
}
],
"typeProperties": {
"source": {
"type": "<source type>"
},
"sink": {
"type": "AzureSearchIndexSink",
"writeBehavior": "Merge"
}
}
}
]
Datentypunterstützung
In der folgenden Tabelle wird angegeben, ob ein Datentyp von Azure KI-Suche unterstützt wird.
| Azure KI-Suche Datentyp | In Azure KI Search-Senke unterstützt |
|---|---|
| String | J |
| Int32 | J |
| Int64 | J |
| Double | J |
| Boolean | J |
| Datenzeitversatz | J |
| Zeichenfolgen-Array | N |
| GeographyPoint | N |
Derzeit werden andere Datentypen, z. B. ComplexType, nicht unterstützt. Eine vollständige Liste der Azure KI-Suche unterstützten Datentypen finden Sie unter Supported data types (Azure KI-Suche).
Zugehöriger Inhalt
Eine Liste der Datenspeicher, die als Quellen und Senken für die Kopieraktivität unterstützt werden, finden Sie in unterstützte Datenspeicher.