Preskoči na sadržaj
TextArray
100% lokalno

Uklonite duplicirane retke po stupce

Ispustite CSV/TSV retke čija se vrijednost u jednom odabranom stupcu već pojavila.

Unos
Rezultat

Uklonite duplicirane retke po stupce

Deduplikacija cijele linije propušta pravi problem: dva retka rijetko su identična, samo dijele istu e-poštu, ID ili SKU dok se sve ostalo razlikuje. Ovaj alat procjenjuje retke prema jednom stupcu po vašem izboru — isti ključ koji se pojavljuje dvaput uklanja kasniji red, zadržavajući skup podataka jedan redak po ključu bez formule proračunske tablice na vidiku.

Zalijepite CSV, TSV ili bilo koje razgraničene retke; graničnik se detektira iz prvog podatkovnog retka (zarez, točka-zarez, tabulator ili crta) s ručnim nadjačavanjem za rubne slučajeve. Odaberite ključni stupac prema njegovom broju temeljenom na 1, recite alatu je li prvi redak zaglavlje - zaglavlja se čuvaju i nikad se ne uspoređuju - i odaberite koje će pojavljivanje preživjeti. Zadrži prvo je zadana postavka; Keep Last je klasičan trik za zapise promjena i izvoze gdje se najnoviji red po ključu nalazi na dnu. Vrijednosti se skraćuju prije usporedbe, a prekidač za zanemarivanje velikih i malih slova spaja [email protected] s [email protected].

Zbroj izvještava o uklanjanjima i broju redaka s obje strane, tako da je lijepljenje koje tiho nije učinilo ništa - pogrešan stupac, pogrešan graničnik - odmah vidljivo. Redovi kraći od ključnog stupca računaju se kao da imaju praznu vrijednost i dedupliciraju se među sobom.

Jedno iskreno ograničenje: razdvajanje je jednostavno, a ne potpuna analiza CSV-a, tako da će polje u navodnicima koje sadrži sam graničnik zbuniti broj stupaca - prvo prođite takve datoteke kroz izmjenjivač CSV graničnika. Sve radi lokalno u vašem pregledniku; vaši podaci nikada ne napuštaju vaš uređaj.

FAQ

Po čemu se to razlikuje od uklanjanja duplih redaka?
Uklanjanje duplikata retka zahtijeva podudaranje cijelog reda. Ovdje se uspoređuje samo odabrani stupac — dva retka s istim ID-om korisnika, ali različitim vremenskim oznakama računaju se kao duplikati, što je obično ono što skup podataka zapravo treba.
Kada trebam zadržati zadnje pojavljivanje umjesto prvog?
Kada je datoteka poredana dodavanjem i najnoviji zapis pobjeđuje: izvozi gdje svako ažuriranje dodaje redak, zapisnike, tokove događaja. Keep last vam daje najnovije stanje po ključu; keep first čuva izvorni unos.
Kako funkcionira automatsko otkrivanje graničnika?
Prvi podatkovni redak se skenira za zareze, točke i zareze, tabulatore i crte, a onaj koji je najčešći pobjeđuje. Zbroj pokazuje koji je upotrijebljen — ako je krivo pogodio, forsirajte ispravan pomoću opcije razgraničenja.
Što je s poljima pod navodnicima koja sadrže zareze?
Razdvajanje je namjerno jednostavno, tako da polje pod navodnicima s ugrađenim graničnikom pomiče stupce za taj redak. Za takve datoteke prvo normalizirajte pomoću CSV alata za razdvajanje (npr. u kartice), a zatim uklonite duplikate ovdje.
Jesu li moji podaci negdje učitani?
Ne. Deduplikacija se u potpunosti izvodi u vašem pregledniku i vaši podaci nikada ne napuštaju vaš uređaj.