Fuzzy lijstvergelijking
Koppel items uit twee lijsten, zelfs als ze verschillen door typo's, spaties of accenten.
Fuzzy lijstvergelijking
Plak twee lijsten en dit hulpmiddel koppelt de items aan elkaar, zelfs als ze niet identiek zijn geschreven. Het lost het dagelijkse probleem op dat exact matchen niet kan: een klantenlijst waar "Jonathan Smith" moet aansluiten op "Jon Smith", een export waar "café Latte" gelijk zou moeten zijn aan "cafe latte", of twee kolommen waarin één invoer een komma heeft die de ander mist. Elk paar krijgt een gelijkenisscore, dus je ziet precies hoe dicht een match is.
Twee opties bepalen hoe coulant de vergelijking is. De gelijkenisdrempel stelt de minimale score in, van 0 tot 100, die een paar moet bereiken. De metriek bepaalt hoe die score wordt berekend: Levenshtein-afstand telt de wijzigingen die nodig zijn om één invoer in de ander om te zetten – goed voor korte tekenreeksen zoals namen en codes. Tekentigram-gelijkenis vergelijkt overlappende drie-tekensfragmenten en gaat beter om met gereorganiseerde of gedeeltelijk herschreven tekst. De opties "Diakritische tekens negeren", "Hoofdlettergebruik negeren" en "Interpunctie negeren" verwijderen opmaakruis dat niet tegen een match mag tellen. "Woordvolgorde normaliseren" laat "Smith, Jonathan" overeenkomen met "Jonathan Smith" door woorden als verzameling in plaats van in volgorde te vergelijken.
Standaard komt elk item op zijn plaats met slechts zijn best match aan de andere kant – zet dat uit om een item met alles boven de drempel te laten matchen, handig bij het controleren van bijna-duplicaten. Niet-overeenkomende items worden afzonderlijk weergegeven wanneer die optie aan staat. Kies "Paren" voor een snelle blik, of "CSV met score" voor een spreadsheet.
Alles draait lokaal in je browser: geen van beide lijsten wordt ergens geüpload, wat van belang is wanneer de gegevens een klantenlijst zijn. Kopieer het resultaat, download het als .txt-bestand, of stuur het rechtstreeks naar een ander hulpmiddel.