Відстань Левенштейна
Виміряйте відстань редагування між двома рядками плюс відсоток схожості.
Відстань Левенштейна
Відстань Левенштейна — це найменша кількість редагувань одного символу — вставок, видалень і замін — необхідних для перетворення одного рядка в інший. Вставте рядок з кожного боку, і цей інструмент повідомить цю відстань разом із нормалізованим коефіцієнтом подібності, обчисленим як (найбільша довжина мінус відстань), поділена на найбільшу довжину: 100% означає, що два рядки ідентичні, і відсоток падає, коли вони розходяться.
Відстань редагування — це метрика, що стоїть за перевіркою орфографії, нечітким пошуком, дедуплікацією та порівнянням послідовностей ДНК. Він відповідає на питання «наскільки далеко одне від одного ці два значення» так, як не може звичайна перевірка на рівність — «кошеня» та «сидить» відрізняються трьома редагуваннями, що набагато ближче, ніж два незв’язані слова. Порівняння назв продуктів, артикулів, заголовків або коротких введених користувачем даних для майже дублікатів — це саме те, для чого він створений.
Три варіанти налаштування порівняння. Ігнорування регістру розглядає "Hello" та "hello" як однакові. Перед порівнянням обріжте пробіли на початку та в кінці пробілів з кожного боку. Порівняння за дозволяє переходити від символів до слів: режим слів вимірює, скільки цілих слів потрібно змінити, що є правильною одиницею для порівняння речень, а не маркерів. Дуже довгі введення обробляються безпечно — оскільки обчислення зростає разом із добутком двох довжин, надзвичайно великі пари повертають коротке сповіщення замість заморожування вкладки.
Усе працює локально у вашому браузері. Ці два рядки ніколи не завантажуються, тому порівняння конфіденційних імен, ключів або неопублікованого тексту є повністю приватним.