Distância Levenshtein
Meça a distância de edição entre duas strings, além de uma porcentagem de similaridade.
Distância Levenshtein
A distância de Levenshtein é o menor número de edições de um único caractere — inserções, exclusões e substituições — necessárias para transformar uma string em outra. Cole uma string em cada lado e esta ferramenta informa essa distância, juntamente com uma taxa de similaridade normalizada calculada como (comprimento mais longo menos distância) dividida pelo comprimento mais longo: 100% significa que as duas strings são idênticas e a porcentagem cai à medida que divergem.
A distância de edição é a métrica por trás dos corretores ortográficos, da pesquisa difusa, da desduplicação e da comparação de sequências de DNA. Ele responde "quão distantes estão esses dois valores" de uma forma que uma verificação simples de igualdade não consegue - "gatinho" e "sentado" diferem em 3 edições, o que é muito mais próximo do que duas palavras não relacionadas. Comparar nomes de produtos, SKUs, títulos ou entradas curtas do usuário para quase duplicatas é exatamente para o que foi criado.
Três opções ajustam a comparação. Ignorar case trata "Hello" e "hello" como iguais. Apare as faixas de espaço em branco à esquerda e à direita de cada lado antes de comparar. Comparar por permite alternar de caracteres para palavras: o modo palavra mede quantas palavras inteiras devem ser alteradas, que é a unidade certa para comparar frases em vez de tokens. Entradas muito longas são tratadas com segurança — como o cálculo aumenta com o produto dos dois comprimentos, pares extremamente grandes retornam um aviso curto em vez de congelar a guia.
Tudo é executado localmente no seu navegador. As duas strings nunca são carregadas, portanto, a comparação de nomes confidenciais, chaves ou texto não publicado é totalmente privada.