Metin benzerliği
İki metnin ne kadar benzer olduğunu ölçün - benzerlik yüzdesi, Levenshtein mesafesi ve kelime örtüşmesi.
Metin benzerliği
İki metni yapıştırın ve iki düzeyde bir benzerlik raporu alın. Karakter düzeyinde Levenshtein uzaklığını (bir metni diğerine dönüştürmek için gereken tek karakterli ekleme, silme ve değiştirmelerin sayısı) ve bundan türetilen bir benzerlik yüzdesini görürsünüz: %100 aynı anlamına gelir, %0 ortak hiçbir şey anlamına gelmez. Kelime düzeyinde rapor, iki kelime kümesinin Jaccard benzerliğini, ayrıca metinlerin kaç benzersiz kelimeyi paylaştığını ve kaç tanesinin yalnızca bunlardan birinde göründüğünü gösterir.
İki seviye farklı sorulara yanıt verir. Karakter benzerliği neredeyse kopyalar için uygundur: bir paragrafın iki versiyonu, orijinalin karşısında düzeltilmiş bir çeviri, kopyalanıp yapıştırılmış ve hafifçe düzenlenmiş ürün açıklamaları. Sıra ve ifadeler farklı olduğunda sözcük örtüşmesi doğrudur ancak sözcük dağarcığı eşleşmelidir; iki makalenin aynı alanı kapsayıp kapsamadığını veya yeniden yazımın gerçekte ne kadar değiştiğini kontrol etmek.
"Merhaba" ve "merhaba"nın bir fark olarak sayılmaması için "Büyük/küçük harf göz ardı" seçeneği varsayılan olarak açıktır; Kelimeleri tek başına karşılaştırmak için "Noktalama işaretlerini yoksay" seçeneğini açın. Çok uzun metinler için bir güvenlik sınırı vardır: karakter ölçümleri her metnin ilk 5.000 karakterine göre hesaplanır (rapor böyle olduğunda bunu belirtir), çünkü düzenleme mesafesi hesaplaması her iki uzunluğun çarpımı ile birlikte büyür. Kelime ölçümleri her zaman tam metinleri kullanır.
Her iki metin de tamamen tarayıcınızda karşılaştırılır; hiçbir şey yüklenmez, dolayısıyla sözleşmeler, taslaklar ve yayınlanmamış kopyalar burada güvendedir.