Перейти к содержанию
TextArray
100% локально

Частотный счетчик слов

Перечислите каждое слово в тексте, указав, сколько раз оно встречается, ранжируя по количеству.

Входные данные
Выходные данные

Частотный счетчик слов

Вставьте текст и получите ранжированный список его слов с указанием частоты появления каждого из них. Писатели используют его, чтобы уловить слово, на которое они слишком сильно опираются, специалисты по поисковой оптимизации — чтобы проверить, какие термины на самом деле выделены на странице, студенты и исследователи — для составления профиля стенограммы интервью, а редакторы — чтобы найти заполнитель перед переписыванием.

По умолчанию подсчет без учета регистра включен, поэтому «Текст» и «текст» используют одну строку; выключите его, чтобы сохранить правописание отдельно. Установите минимальную длину слова, чтобы отбросить короткие функциональные слова, или включите пропуск общих слов, что удалит примерно две дюжины наиболее часто встречающихся слов на языке, на котором вы просматриваете. Отсортируйте по количеству, чтобы увидеть, что доминирует, или по алфавиту, чтобы найти определенное слово, и установите ограничение на количество строк, чтобы сохранять только верхние записи — 0 перечисляет все.

Слова сопоставляются с буквенными правилами Юникода, поэтому «čučoriedka», «Grüße», «źdźbło» и «gyümölcs» остаются целыми, а не разделяются на букву с ударением, а «не» и «хорошо известный» считаются за одно слово. Инструмент считает словоформы точно так, как они написаны: он не лемматизирует, поэтому «бег» и «бег» занимают отдельные строки. Счетчики выравниваются по правому краю, поэтому столбец выстраивается в линию, а в подсчете отображаются уникальные слова, общее количество подсчитанных слов и наиболее часто встречающееся слово с его количеством.

Все рассчитывается в вашем браузере. Ваш текст никогда не загружается, поэтому можно безопасно вставлять черновики, клиентские документы и исследовательские материалы. Скопируйте список, загрузите его в виде файла .txt или переместите обратно на вход, чтобы отсортировать или очистить его дальше.

FAQ

Какие общие слова пропускаются?
Около 25 наиболее часто встречающихся служебных слов для каждого языка — «the», «and», «of» в английском языке и их эквиваленты в других языках. Список намеренно небольшой: он удаляет очевидный шум, а не действует как полный корпус стоп-слов. Он соответствует языку страницы, поэтому вставьте немецкий текст на английскую страницу, и будет применен английский список.
Группирует ли он «бег» и «бег» вместе?
Нет. Инструмент подсчитывает словоформы точно так, как они появляются, без каких-либо стеммингов или лемматизации. Единственное и множественное число, а также каждая изменяемая форма имеют свой собственный ряд.
Правильно ли учитываются слова с акцентом и неанглийские слова?
Да. Сопоставление слов использует свойства букв Юникода, поэтому словацкие, чешские, немецкие, польские и венгерские буквы остаются внутри слов, а не разбиваются на части. Соединения, написанные через дефис, и апострофы также сохраняются целиком.
Почему в подсчете указано слово, которого нет в первой строке?
Подсчет всегда показывает наиболее часто встречающееся слово во всем тексте. Сортировка по алфавиту или установка ограничения на количество строк изменяет список, который вы видите, но не то, какое слово на самом деле лидирует.
Мой текст где-нибудь загружен?
Нет. Инструмент полностью работает в вашем браузере, и ваш текст никогда не покидает ваше устройство.