Semelhança de texto
Meça o quão semelhantes são dois textos – porcentagem de similaridade, distância de Levenshtein e sobreposição de palavras.
Semelhança de texto
Cole dois textos e obtenha um relatório de similaridade em dois níveis. No nível do caractere você vê a distância de Levenshtein — o número de inserções, exclusões e substituições de um único caractere necessárias para transformar um texto em outro — e uma porcentagem de similaridade derivada dela: 100% significa idêntico, 0% significa nada em comum. No nível das palavras, o relatório mostra a similaridade Jaccard dos dois conjuntos de palavras, além de quantas palavras únicas os textos compartilham e quantas aparecem apenas em um deles.
Os dois níveis respondem a perguntas diferentes. A semelhança de caracteres é adequada para quase duplicatas: duas versões de um parágrafo, uma tradução corrigida em relação ao original, descrições de produtos que foram copiadas e coladas e levemente editadas. A sobreposição de palavras é correta quando a ordem e o fraseado diferem, mas o vocabulário deve corresponder – verificando se dois artigos cobrem o mesmo assunto ou o quanto uma reescrita realmente mudou.
"Ignorar maiúsculas e minúsculas" está ativado por padrão para que "Olá" e "Olá" não contem como diferença; ative "Ignorar pontuação" para comparar apenas as palavras. Para textos muito longos há um limite de segurança: as métricas de caracteres são calculadas nos primeiros 5.000 caracteres de cada texto (o relatório diz isso quando isso acontece), porque o cálculo da distância de edição cresce com o produto de ambos os comprimentos. As métricas do Word sempre usam os textos completos.
Ambos os textos são comparados inteiramente no seu navegador – nada é carregado, então contratos, manuscritos e cópias não publicadas estão seguros aqui.