Ga naar inhoud
100% lokaal

Levenshtein-afstand

Meet de bewerkingsafstand tussen twee strings, plus een gelijkenispercentage.

Invoer
Vergelijk met
Uitvoer

Levenshtein-afstand

De Levenshtein-afstand is het kleinste aantal bewerkingen van één teken (invoegingen, verwijderingen en vervangingen) die nodig zijn om de ene tekenreeks in de andere te veranderen. Plak een string aan elke kant en deze tool rapporteert die afstand, samen met een genormaliseerde gelijkenisverhouding, berekend als (langste lengte minus afstand) gedeeld door de langste lengte: 100% betekent dat de twee strings identiek zijn, en het percentage daalt naarmate ze uiteenlopen.

De bewerkingsafstand is de maatstaf achter spellingcontrole, fuzzy search, deduplicatie en vergelijking van DNA-sequenties. Het antwoordt "hoe ver deze twee waarden uit elkaar liggen" op een manier die een gewone gelijkheidscontrole niet kan doen: "kitten" en "sitting" verschillen met 3 bewerkingen, wat veel dichter bij elkaar ligt dan twee niet-gerelateerde woorden. Het vergelijken van productnamen, SKU's, koppen of korte gebruikersinvoer voor bijna duplicaten is precies waarvoor het is gebouwd.

Drie opties stemmen de vergelijking af. Hoofdlettergebruik negeren behandelt 'Hallo' en 'Hallo' als gelijk. Knip witruimtestroken voor- en achterspaties aan elke kant af voordat u gaat vergelijken. Met Vergelijken kun je overschakelen van tekens naar woorden: de woordmodus meet hoeveel hele woorden moeten veranderen, wat de juiste eenheid is om zinnen te vergelijken in plaats van tokens. Zeer lange invoergegevens worden veilig afgehandeld: omdat de berekening meegroeit met het product van de twee lengtes, retourneren extreem grote paren een korte termijn in plaats van dat de tab wordt bevroren.

Alles draait lokaal in uw browser. De twee strings worden nooit geüpload, dus het vergelijken van vertrouwelijke namen, sleutels of niet-gepubliceerde tekst is volledig privé.

FAQ

Wat is de Levenshtein-afstand?
Het is het minimumaantal bewerkingen van één teken (invoegingen, verwijderingen of vervangingen) dat nodig is om de eerste tekenreeks in de tweede te veranderen. Het veranderen van "kitten" in "zitten" kost 3 bewerkingen, dus de afstand is 3.
Hoe wordt het gelijkenispercentage berekend?
Het is de lengte van de langere tekenreeks minus de bewerkingsafstand, gedeeld door die lengte, weergegeven als een percentage. Identieke snaren scoren 100%; twee totaal verschillende snaren van gelijke lengte scoren 0%.
Wat is het verschil tussen vergelijken op karakters en op woorden?
De tekenmodus telt bewerkingen van één teken, wat geschikt is voor korte tekenreeksen en typefoutdetectie. De Woordmodus behandelt elk heel woord als één eenheid en meet dus hoeveel woorden er zijn veranderd – beter voor het vergelijken van zinnen of woordgroepen.
Is er een limiet aan de invoergrootte?
De berekening groeit met het product van beide lengtes, dus extreem grote paren zouden de tab bevriezen. Wanneer die limiet is bereikt, toont de tool een korte melding waarin u wordt gevraagd de invoer in te korten in plaats van te proberen te berekenen.
Wordt mijn tekst ergens geüpload?
Nee. De vergelijking wordt volledig in uw browser uitgevoerd, zonder netwerkverzoeken, dus beide strings blijven op uw apparaat staan.