Fuzzy listmatchning
Koppla ihop poster från två listor även när de skiljer sig åt genom stavfel, mellanslag eller accenter.
Fuzzy listmatchning
Klistra in två listor och detta verktyg kopplar ihop posterna, även om de inte är identiska. Det löser det vardagliga problem som exakt matchning inte kan: en kundlista där "Jonathan Smith" behöver matcha "Jon Smith", en export där "café Latte" ska matcha "cafe latte", eller två kolumner där en post har ett kommatecken som den andra saknar. Varje par får ett likhetspoäng, så du ser exakt hur nära en matchning är.
Två alternativ styr hur förlåtande jämförelsen är. Likhetsestränsen sätter minsta poäng, från 0 till 100, som ett par måste uppnå. Måttenheterna avgör hur det poänget beräknas: Levenshtein-avstånd räknar ändringar som behövs för att förvandla en post till den andra – bra för korta strängar som namn och koder. Teckentrigram-likhet jämför överlappande tresiffriga fragment och hanterar omordnad eller delvis omskriven text bättre. Alternativen "Ignorera diakritiska tecken", "Ignorera skiftläge" och "Ignorera skiljetecken" tar bort formateringsbrus som inte bör räknas mot en matchning. "Normalisera ordning" låter "Smith, Jonathan" matcha "Jonathan Smith" genom att jämföra ord som en uppsättning istället för i ordning.
Som standard matchas varje post högst en gång till sin bästa motsvarighet på andra sidan – stäng av det för att låta en post matcha allt över tröskeln, användbart när man granskar nästan-dubbletter. Omatchade poster visas separat när det alternativet är på. Välj "Par" för en snabb läsning eller "CSV med poäng" för ett kalkylblad.
Allt körs lokalt i din webbläsare: ingen av listorna laddas upp någonstans, vilket är viktigt när data är en kundlista. Kopiera resultatet, ladda ned det som en .txt-fil eller skicka det direkt till ett annat verktyg för vidare arbete.