Удалить повторяющиеся слова
Удаляйте повторяющиеся слова из текста и сохраняйте только первое появление каждого из них.
Удалить повторяющиеся слова
Вставьте текст, и этот инструмент вернет его с удаленными повторяющимися словами, сохраняя первое появление каждого слова. Это самый быстрый способ привести в порядок список ключевых слов, поле тега, набор атрибутов продукта, разделенных запятыми, или стенограмму, в которой говорящий произнес одно и то же слово дважды подряд.
Два варианта определяют, какое слово считать одним и тем же. По умолчанию параметр «Согласование регистра» отключен, поэтому «The» и «the» представляют собой одно слово, а написание, которое вы написали первым, остается таким. «Игнорировать знаки препинания» включено по умолчанию, поэтому «красный» и «красный» соответствуют друг другу, в то время как в выводе запятые остаются именно там, где они были — меняется только сравнение, а не текст.
«Только последовательные повторы» — это вариант, который можно использовать при бегущей прозе. Он пропускает слово только тогда, когда оно сразу повторяется, поэтому «кот сидел на циновке» становится «кот сидел на циновке», и второе «the», принадлежащее этому слову, сохраняется. Без этого инструмент выполняет дедупликацию по всему тексту, что вам нужно для списков и тегов, но приведет к уменьшению количества обычных предложений, в которых одно и то же слово допустимо повторяется.
Интервалы и разрывы строк сохраняются: удаленное слово занимает место перед ним, поэтому ничто не оказывается с двойным интервалом, и ваши строки остаются на своих местах. Допускаются окончания строк как в Windows, так и в Unix. Все работает в вашем браузере — текст никогда не загружается, поэтому личные заметки, стенограммы клиентов и неопубликованные исследования ключевых слов находятся здесь в безопасности. Скопируйте результат, загрузите его в виде файла .txt или переместите обратно на вход, чтобы создать цепочку еще одного шага очистки.