Verwijder dubbele rijen per kolom
Verwijder CSV/TSV-rijen waarvan de waarde al in een gekozen kolom verscheen.
Verwijder dubbele rijen per kolom
Bij deduplicatie van hele regels wordt het echte probleem over het hoofd gezien: twee rijen zijn zelden identiek, ze delen alleen hetzelfde e-mailadres, ID of SKU, terwijl al het andere verschilt. Deze tool beoordeelt rijen op basis van één kolom naar keuze: als dezelfde sleutel twee keer verschijnt, wordt de latere rij verwijderd, waardoor de gegevensset één rij per sleutel blijft zonder dat er een spreadsheetformule in zicht is.
Plak CSV, TSV of gescheiden rijen; het scheidingsteken wordt gedetecteerd vanaf de eerste dataregel (komma, puntkomma, tab of pijp) met een handmatige overschrijving voor randgevallen. Kies de sleutelkolom op basis van het op 1 gebaseerde getal, vertel de tool of de eerste rij een koptekst is (kopteksten worden bewaard en nooit vergeleken) en kies welke gebeurtenis overleeft. Eerst bewaren is de standaard; als laatste bewaren is de klassieke truc voor changelogs en exports waarbij de nieuwste rij per sleutel onderaan staat. Waarden worden vóór vergelijking bijgesneden, en een schakelaar voor negeren van hoofdletters voegt [email protected] samen met [email protected].
De telling rapporteert de verwijderingen en het aantal regels aan weerszijden, dus een pasta die in stilte niets deed (verkeerde kolom, verkeerd scheidingsteken) is onmiddellijk zichtbaar. Rijen die korter zijn dan de sleutelkolom tellen daar als een lege waarde en worden onderling ontdubbeld.
Eén eerlijke beperking: het splitsen is duidelijk, geen volledige CSV-parsering, dus een veld tussen aanhalingstekens dat het scheidingsteken zelf bevat, zal het aantal kolommen verwarren - voer dergelijke bestanden eerst door de CSV-scheidingstekenwisselaar. Alles draait lokaal in uw browser; uw gegevens verlaten nooit uw apparaat.