Hinweis
Für den Zugriff auf diese Seite ist eine Autorisierung erforderlich. Sie können versuchen, sich anzumelden oder das Verzeichnis zu wechseln.
Für den Zugriff auf diese Seite ist eine Autorisierung erforderlich. Sie können versuchen, das Verzeichnis zu wechseln.
Gilt für:SQL Server
SSIS Integration Runtime in Azure Data Factory
Das Paket muss bereits mindestens einen Datenflusstask und eine Quelle enthalten, damit Sie eine Transformation für Fuzzygruppierung hinzufügen und konfigurieren können.
So implementieren Sie eine Transformation für Fuzzygruppierung in einem Datenfluss
Öffnen Sie in SQL Server Data Tools (SSDT) das Integration Services-Projekt mit dem gewünschten Paket.
Doppelklicken Sie im Projektmappen-Explorer auf das Paket, um es zu öffnen.
Klicken Sie auf die Registerkarte Datenfluss , und ziehen Sie dann aus dem Fenster Toolboxdie Transformation für Fuzzygruppierung auf die Entwurfsoberfläche.
Verbinden Sie die Transformation für Fuzzygruppierung mit dem Datenfluss, indem Sie den Konnektor von der Datenquelle oder einer vorherigen Transformation auf die Transformation für Fuzzygruppierung ziehen.
Doppelklicken Sie auf die Transformation Fuzzy-Gruppierung.
Wählen Sie im Dialogfeld Editor für die Fuzzygruppierungstransformation auf der Registerkarte Verbindungs-Manager einen OLE DB-Verbindungs-Manager aus, der eine Verbindung zu einer SQL Server-Datenbank herstellt.
Hinweis
Für die Transformation muss eine Verbindung mit einer SQL Server -Datenbank vorhanden sein, damit temporäre Tabellen und Indizes erstellt werden können.
Klicken Sie auf die Registerkarte Spalten , und aktivieren Sie in der Liste Verfügbare Eingabespalten die Kontrollkästchen der Eingabespalten, die zum Identifizieren ähnlicher Zeilen im Dataset verwendet werden sollen.
Aktivieren Sie das Kontrollkästchen in der Spalte Pass Through, um die Eingabespalten auszuwählen, die an die Transformationsausgabe weitergeleitet werden sollen. Durchleitspalten werden bei der Identifizierung doppelter Zeilen nicht berücksichtigt.
Hinweis
Eingabespalten, die zum Gruppieren verwendet werden, werden automatisch als Pass-Through-Spalten ausgewählt. Die Auswahl dieser Spalten kann nicht aufgehoben werden, während sie zum Gruppieren verwendet werden.
Aktualisieren Sie optional die Namen von Ausgabespalten in der Ausgabealias -Spalte.
Aktualisieren Sie optional die Namen von bereinigten Spalten in der Gruppenausgabealias -Spalte.
Hinweis
Die Standardnamen von Spalten sind die Namen der Eingabespalten mit dem Suffix "_clean".
Optional können Sie den in der Spalte Match Type verwendeten Match-Typ aktualisieren.
Hinweis
Mindestens eine Spalte muss Fuzzy-Matching verwenden.
Geben Sie die minimale Ähnlichkeit von Spalten in der Minimale Ähnlichkeit -Spalte an. Der Wert muss zwischen 0 und 1 liegen. Je näher der Wert an 1 liegt, desto ähnlicher müssen die Werte in den Eingabespalten sein, um eine Gruppe zu bilden. Eine minimale Ähnlichkeit von 1 bedeutet eine genaue Übereinstimmung.
Aktualisieren Sie optional die Namen von Ähnlichkeitsspalten in der Ähnlichkeitsausgabealias -Spalte.
Aktualisieren Sie die Werte in der Zahlen -Spalte, um die Behandlung von Zahlen in Datenwerten anzugeben.
Um anzugeben, wie die Transformation die Zeichenfolgendaten in einer Spalte vergleicht, ändern Sie die Standardauswahl von Vergleichsoptionen in der Vergleichsflags -Spalte.
Klicken Sie auf die Registerkarte Erweitert, um die Namen der Spalten zu ändern, die von der Transformation zur Ausgabe für den eindeutigen Zeilenbezeichner (_key_in), den Bezeichner für doppelte Zeilen (_key_out) und den Ähnlichkeitswert (_score) hinzugefügt werden.
Passen Sie optional den Schwellenwert für die Ähnlichkeit mithilfe des Schiebereglers an.
Optional können Sie die Kontrollkästchen für die Token-Trennzeichen deaktivieren, um Trennzeichen in den Daten zu ignorieren.
Klicken Sie auf OK.
Klicken Sie im Menü Datei auf Ausgewählte Elemente speichern , um das aktualisierte Paket zu speichern.