Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Wanneer u regels instelt om uw gegevens te harmoniseren in een klantprofiel, kunt u het beste rekening houden met de volgende best practices:
Tijd voor samenvoegen versus volledige overeenkomst in balans brengen Het proberen om elke mogelijke overeenkomst vast te leggen, leidt tot veel regels en kost unificatie veel tijd.
Regels geleidelijk toevoegen en de resultaten bijhouden. Verwijder regels die het resultaat van de afstemming niet verbeteren.
Elke tabel ontdoen van dubbelingen, zodat elke klant in één rij wordt weergegeven.
Gebruik normalisatie om variaties te standaardiseren in de manier waarop gegevens zijn ingevoerd, zoals Straat versus Str versus Str. versus str.
Gebruik fuzzy matches strategisch om typefouten en andere fouten zoals bob@contoso.com en bob@contoso.cm te corrigeren. Fuzzy matches duren langer dan exacte matches. Test altijd of de extra tijd voor fuzzy matching het extra matchpercentage waard is.
Beperk de reikwijdte van overeenkomsten met exacte match. Zorg ervoor dat elke regel met fuzzy-voorwaarden ten minste één exacte overeenkomstvoorwaarde heeft.
Koppel geen kolommen die sterk herhaalde gegevens bevatten. Zorg ervoor dat kolommen met fuzzy matches geen waarden bevatten die vaak terugkomen, zoals de standaardwaarde 'Voornaam' van een formulier.
Prestaties van harmonisering
Elke regel heeft tijd nodig om uit te voeren. Patronen, zoals het vergelijken van elke tabel met elke andere tabel of het proberen vast te leggen van elke mogelijke recordovereenkomst, kunnen leiden tot lange verwerkingstijden voor de harmonisatie. Het levert ook weinig of geen extra overeenkomsten op vergeleken met een plan waarbij elke tabel met een basistabel wordt vergeleken.
De beste aanpak is om te beginnen met een basisset aan regels waarvan u weet dat ze nodig zijn, zoals het vergelijken van elke tabel met uw primaire tabel. Uw primaire tabel moet de tabel zijn met de meest volledige en correcte gegevens. Deze tabel moet bovenaan worden geordend in de stap Harmonisatie van overeenkomstregels.
Voeg geleidelijk meerdere regels toe en kijk hoelang het duurt om de wijzigingen door te voeren en of uw resultaten verbeteren. Ga naar Instellingen>Systeem>Status en selecteer Overeenkomst om te zien hoelang ontdubbelen en afstemmen duurden voor elke harmonisatierun.
Bekijk de regelstatistieken op de pagina's Ontdubbelingsregels en Overeenkomstregels om te zien of het aantal Unieke records verandert. Als een nieuwe regel overeenkomt met bepaalde records en het unieke recordaantal niet verandert, dan identificeert een eerdere regel die overeenkomsten.
Klantgegevens
In de stap Klantgegevens:
Sluit kolommen uit die niet nodig zijn voor de overeenkomstregels of die u niet wilt opnemen in het uiteindelijke klantprofiel.
Bekijk de kolombeschrijvingen die via intelligente toewijzing zijn geselecteerd.
Niet alle kolommen hoeven te worden toegewezen. Door veelvoorkomende kolommen, zoals e-mail- en adresvelden, te koppelen, kan Customer Insights vervolgprocessen vergemakkelijken, maar kolommen met een unieke id of een specifiek doel binnen uw bedrijf kunnen ongemapt blijven.
Deduplicatie
Gebruik ontdubbelingsregels om dubbele klantrecords in een tabel te verwijderen, zodat elke klant in één rij in elke tabel staat. Een goede regel identificeert een unieke klant.
In dit eenvoudige voorbeeld delen records 1, 2 en 3 een e-mailadres of telefoonnummer en vertegenwoordigen ze dezelfde persoon.
| Id | Naam | Telefoon | |
|---|---|---|---|
| 1 | Persoon 1 | (425) 555-1111 | AAA@A.com |
| 2 | Persoon 1 | (425) 555-1111 | BBB@B.com |
| 5 | Persoon 1 | (425) 555-2222 | BBB@B.com |
| 4 | Persoon 2 | (206) 555-9999 | Person2@contoso.com |
We willen niet alleen op naam matchen, omdat hierdoor verschillende mensen met dezelfde naam zouden worden gematcht.
Maak Regel 1 met Naam en Telefoonnummer, die overeenkomt met records 1 en 2.
Maak Regel 2 met Naam en E-mailadres, die overeenkomt met records 2 en 3.
De combinatie van Regel 1 en Regel 2 vormt één overeenkomstgroep omdat ze record 2 delen.
U bepaalt het aantal regels en voorwaarden waarmee u uw klanten eenduidig identificeert. De exacte regels zijn afhankelijk van de gegevens waarover u beschikt, de kwaliteit van uw gegevens en hoe uitgebreid u het ontdubbelingsproces wilt laten zijn.
Normalisatie
Gebruik normalisatie om gegevens te standaardiseren voor betere afstemming. Normalisatie presteert goed bij grote gegevenssets.
De genormaliseerde gegevens worden alleen gebruikt voor vergelijkingsdoeleinden om klantgegevens beter op elkaar af te stemmen. De gegevens in de uiteindelijke geharmoniseerde klantprofieluitvoer worden hierdoor niet gewijzigd.
Exacte overeenkomst
Bepaal met precisie hoe dicht twee tekenreeksen bij elkaar moeten liggen om als overeenkomst te worden beschouwd. Voor de standaardprecisie-instelling is een exacte overeenkomst vereist. Elke andere waarde maakt fuzzy overeenkomst voor die voorwaarde mogelijk.
De precisie kan worden ingesteld op laag (30% overeenkomst), gemiddeld (60% overeenkomst) en hoog (80% overeenkomst). U kunt de precisie ook aanpassen en instellen in stappen van 1%.
Exacte overeenkomstvoorwaarden
De voorwaarden voor exacte overeenkomsten worden eerst toegepast om een kleinere verzameling waarden voor fuzzy matches te verkrijgen. Om effectief te zijn, moeten de exacte overeenkomstvoorwaarden in redelijke mate uniek zijn. Als al uw klanten bijvoorbeeld in hetzelfde land/dezelfde regio wonen, helpt een exacte overeenkomst op basis van land/regio niet om het bereik te beperken.
Velden zoals volledige naam, e-mailadres, telefoonnummer of adres hebben een hoge mate van uniciteit en zijn zeer geschikt voor een exacte overeenkomst.
Zorg ervoor dat de kolom die u gebruikt voor een exacte overeenkomstvoorwaarde geen waarden bevat die veelvuldig worden herhaald, zoals de standaardwaarde 'Voornaam' die door een formulier wordt vastgelegd. Met Customer Insights kunt u gegevenskolommen profileren om inzicht te krijgen in de meest voorkomende waarden. U kunt gegevensprofilering inschakelen voor Azure Data Lake-verbindingen (met behulp van Common Data Model of Delta-indeling) en Synapse. Het gegevensprofiel wordt uitgevoerd wanneer de gegevensbron de volgende keer wordt vernieuwd. Ga voor meer informatie naar Gegevensprofilering.
Vage overeenkomst
Gebruik fuzzy matching om tekenreeksen te vinden die sterk op elkaar lijken, maar niet exact overeenkomen door typfouten of andere kleine variaties. Gebruik fuzzy matching doordacht, omdat dit trager is dan exacte overeenkomsten. Zorg ervoor dat in elke regel met fuzzy-voorwaarden minimaal één voorwaarde voor een exacte overeenkomst aanwezig is.
Fuzzy matching is niet bedoeld om naamvarianten zoals Suzzie en Suzanne te herkennen. Deze variaties worden beter vastgelegd met het normalisatiepatroon Type: Naam of de aangepaste Aliasovereenkomst waarbij klanten hun lijst met naamvariaties kunnen invoeren die ze als overeenkomsten willen beschouwen.
U kunt voorwaarden aan een regel toevoegen, zoals het matchen van FirstName en Telefoon. Voorwaarden binnen een bepaalde regel zijn "AND"-voorwaarden. Alle voorwaarden moeten overeenkomen, anders komen de rijen niet overeen. Afzonderlijke regels zijn 'OR'-voorwaarden. Als Regel 1 niet overeenkomt met de rijen, dan worden de rijen vergeleken met Regel 2.
Notitie
Alleen kolommen met gegevens van het type tekenreeks kunnen fuzzy-overeenkomsten gebruiken. Voor kolommen met andere gegevenstypen, zoals geheel getal, dubbel of datum/tijd, is het precisieveld alleen-lezen en ingesteld op de exacte overeenkomst.
Berekeningen voor fuzzy matching
Fuzzy overeenkomsten worden bepaald door de bewerkingsafstandsscore tussen twee tekenreeksen te berekenen. Als de score gelijk is aan of hoger is dan de precisiedrempelwaarde, worden de tekenreeksen als overeenstemmend beschouwd.
De bewerkingsafstand is het aantal bewerkingen dat nodig is om de ene tekenreeks om te zetten in een andere tekenreeks, door een teken toe te voegen, te verwijderen of te wijzigen.
De strings "robert2020@hotmail.com" en "robrt2020@hotmail.cm" hebben bijvoorbeeld een bewerkingsafstand van twee wanneer we de tekens e en o verwijderen. Om de bewerkingsafstand te berekenen gebruikt u deze formule: (Basisreekslengte – Bewerkafstand) / Basisreekslengte.
| Basistekenreeks | Vergelijkingstekenreeks | Score |
|---|---|---|
| robert2020@hotmail.com | robrt2020@hotmail.cm | (20 - 2)/20 = 0,9 |