Textlikhet
Mät hur lika två texter är — likhetsprocent, Levenshtein-avstånd och ord överlappar varandra.
Textlikhet
Klistra in två texter och få en likhetsrapport på två nivåer. På teckennivån ser du Levenshtein-avståndet — antalet infogningar, raderingar och ersättningar med enstaka tecken som behövs för att förvandla en text till den andra — och en likhetsprocent som härrör från det: 100 % betyder identisk, 0 % betyder ingenting gemensamt. På ordnivå visar rapporten Jaccard-likheten mellan de två orduppsättningarna, plus hur många unika ord texterna delar och hur många som endast förekommer i en av dem.
De två nivåerna svarar på olika frågor. Karaktärslikhet är rätt för nästan dubbletter: två versioner av ett stycke, en korrigerad översättning mot originalet, produktbeskrivningar som kopierades inklistrade och lätt redigerade. Ordöverlappning är rätt när ordning och frasering skiljer sig men ordförrådet bör matcha – kontrollera om två artiklar täcker samma grund eller hur mycket en omskrivning faktiskt har förändrats.
"Ignorera skiftläge" är på som standard så att "Hej" och "hej" inte räknas som en skillnad; slå på "Ignorera skiljetecken" för att jämföra bara orden. För mycket långa texter finns det en säkerhetsgräns: teckenmått beräknas på de första 5 000 tecknen i varje text (rapporten säger det när det händer), eftersom redigeringsavståndsberäkningen växer med produkten av båda längderna. Ordmätningar använder alltid hela texten.
Båda texterna jämförs helt i din webbläsare — ingenting laddas upp, så kontrakt, manuskript och opublicerade kopior är säkra här.