Ta bort dubbletter av rader efter kolumn
Släpp CSV/TSV-rader vars värde i en vald kolumn redan har visats.
Ta bort dubbletter av rader efter kolumn
Hellinjededuplicering missar det verkliga problemet: två rader är sällan identiska, de delar bara samma e-post, ID eller SKU medan allt annat skiljer sig. Det här verktyget bedömer rader efter en kolumn som du väljer - samma nyckel som visas två gånger tar bort den senare raden, vilket behåller datamängden en rad per nyckel utan en kalkylbladsformel i sikte.
Klistra in CSV, TSV eller andra avgränsade rader; avgränsaren detekteras från den första dataraden (komma, semikolon, tabb eller rör) med en manuell åsidosättning för kantfall. Välj nyckelkolumnen efter dess 1-baserade nummer, tala om för verktyget om den första raden är en rubrik - rubriker bevaras och jämförs aldrig - och välj vilken förekomst som överlever. Behåll först är standard; keep last är det klassiska tricket för ändringsloggar och exporter där den senaste raden per nyckel sitter längst ner. Värden beskärs före jämförelse, och en växel för ignorera skiftläge sammanfogar [email protected] med [email protected].
Sammanställningen rapporterar borttagningarna och radräkningen på vardera sidan, så en inklistring som inte gjorde något - fel kolumn, fel avgränsare - är omedelbart synlig. Rader som är kortare än nyckelkolumnen räknas som att ha ett tomt värde där och deduplicerar sinsemellan.
En ärlig begränsning: uppdelningen är enkel, inte en fullständig CSV-analys, så ett citerat fält som innehåller själva avgränsaren kommer att förvirra kolumnantalet – kör sådana filer genom CSV-avgränsarens växlare först. Allt körs lokalt i din webbläsare; din data lämnar aldrig din enhet.