Видаліть повторювані рядки за стовпцями
Видалити рядки CSV/TSV, значення яких уже з’явилися в одному вибраному стовпці.
Видаліть повторювані рядки за стовпцями
Дедуплікація цілого рядка упускає справжню проблему: два рядки рідко бувають ідентичними, вони просто мають однакову електронну адресу, ID або SKU, а все інше відрізняється. Цей інструмент оцінює рядки за одним стовпцем на ваш вибір — той самий ключ, який з’являється двічі, видаляє пізніший рядок, зберігаючи набір даних по одному рядку на ключ без формули електронної таблиці.
Вставте CSV, TSV або будь-які розділені рядки; роздільник визначається з першого рядка даних (кома, крапка з комою, табуляція або вертикальна лінія) з ручним перевизначенням для крайніх випадків. Виберіть ключовий стовпець за його числом від 1, повідомте інструменту, чи є перший рядок заголовком — заголовки зберігаються й ніколи не порівнюються — і виберіть, який випадок залишиться. Зберігати першим є типовим; Зберігати останнім — це класичний трюк для журналів змін і експорту, де найновіший рядок для ключа знаходиться внизу. Значення обрізаються перед порівнянням, а перемикач ігнорування регістру об’єднує [email protected] із [email protected].
Підрахунок повідомляє про видалення та кількість рядків з обох боків, тож вставлення, яке мовчки нічого не робило — неправильний стовпець, неправильний роздільник — одразу видно. Рядки, коротші за ключовий стовпець, вважаються такими, що мають порожнє значення та дедуплікуються між собою.
Одне чесне обмеження: розділення є звичайним, а не повним синтаксичним аналізом CSV, тому поле в лапках, яке містить сам роздільник, плутатиме підрахунок стовпців — спершу пропустіть такі файли через засіб зміни роздільників CSV. Усе працює локально у вашому браузері; ваші дані ніколи не залишають ваш пристрій.