Levenshtein-afstand
Meet de bewerkingsafstand tussen twee strings, plus een gelijkenispercentage.
Levenshtein-afstand
De Levenshtein-afstand is het kleinste aantal bewerkingen van één teken (invoegingen, verwijderingen en vervangingen) die nodig zijn om de ene tekenreeks in de andere te veranderen. Plak een string aan elke kant en deze tool rapporteert die afstand, samen met een genormaliseerde gelijkenisverhouding, berekend als (langste lengte minus afstand) gedeeld door de langste lengte: 100% betekent dat de twee strings identiek zijn, en het percentage daalt naarmate ze uiteenlopen.
De bewerkingsafstand is de maatstaf achter spellingcontrole, fuzzy search, deduplicatie en vergelijking van DNA-sequenties. Het antwoordt "hoe ver deze twee waarden uit elkaar liggen" op een manier die een gewone gelijkheidscontrole niet kan doen: "kitten" en "sitting" verschillen met 3 bewerkingen, wat veel dichter bij elkaar ligt dan twee niet-gerelateerde woorden. Het vergelijken van productnamen, SKU's, koppen of korte gebruikersinvoer voor bijna duplicaten is precies waarvoor het is gebouwd.
Drie opties stemmen de vergelijking af. Hoofdlettergebruik negeren behandelt 'Hallo' en 'Hallo' als gelijk. Knip witruimtestroken voor- en achterspaties aan elke kant af voordat u gaat vergelijken. Met Vergelijken kun je overschakelen van tekens naar woorden: de woordmodus meet hoeveel hele woorden moeten veranderen, wat de juiste eenheid is om zinnen te vergelijken in plaats van tokens. Zeer lange invoergegevens worden veilig afgehandeld: omdat de berekening meegroeit met het product van de twee lengtes, retourneren extreem grote paren een korte termijn in plaats van dat de tab wordt bevroren.
Alles draait lokaal in uw browser. De twee strings worden nooit geüpload, dus het vergelijken van vertrouwelijke namen, sleutels of niet-gepubliceerde tekst is volledig privé.