Mehko ujemanje seznamov
Uskladi postavke iz dveh seznamov čeprav se razlikujejo po tipki, presledku ali naglasom.
Mehko ujemanje seznamov
Prilepite dva seznama in to orodje ujema postavke, ki so podobne, tudi ko niso napisane enako. Rešuje vsakodnevno zmešnjavo, s katero se natančno ujemanje ne more soočiti: seznam strank, kjer je potrebno "Janez Novak" uskladiti z "J. Novak", izvoz, kjer je "Kava Latte" potrebno uskladiti z "kava latte", ali dva stolpca, kjer ima en vnos vejico, drugemu pa manjka. Vsak par ima oceno podobnosti, zato vidite natančno, kako blizu je ujemanja, namesto da bi morali ugibati.
Dve možnosti nadzorujeta, kako stroga je primerjava. Prag podobnosti nastavi najmanjšo oceno, od 0 do 100, ki jo mora par doseči, da se šteje za ujemanje. Metrika izbira, kako se ta ocena izračuna: Levenshteinova razdalja šteje urejanja, potrebna, da en vnos spremenite v drugega, kar je primerno za kratke nize, kot so imena in kode, medtem ko podobnost znakov-trigramov primerja prekrivajuče se tri-znakove in se bolje sooči s preurejenimi ali delno prepisanimi besedili. Ignoriraj naglase, ignoriraj velikost črk in ignoriraj ločila odstranijo hrup oblikovanja, ki ne bi smel vplivati na ujemanje, normalizacija vrstnega reda besed pa omogoči, da se "Novak, Janez" ujema z "Janez Novak" z primerjavo besed kot niza namesto zaporedja.
Nazačetku se vsaka postavka ujema največ enkrat, z edino najboljšo protistransko - to izključite, da se postavka ujema z vsem nad pragom, kar je koristno pri preverjanju skoraj-podvojenih namesto povezovanja čistih seznamov. Neujemate postavke so navedene ločeno, kadar je ta možnost vključena, zato nič ne izgine tiho. Izberite preproste pare za hitro branje ali CSV s točkami za preglednico.
Vse poteka lokalno v vašem brskalniku: nobeden seznam se ne pošlje nikamor, kar je pomembno, ko so podatki seznam strank ali kontaktov. Kopirajte rezultat, ga preuzmite kot .txt datoteko ali ga nemudoma pošljite v drugo orodje, da nadaljujete z delom.