Перейти к содержанию
TextArray
100% локально

Буквенный частотомер

Подсчитайте, как часто каждая буква встречается в тексте, используя количество и проценты.

Входные данные
Выходные данные

Буквенный частотомер

Вставьте любой текст и получите таблицу его символов, каждый со своим количеством и процентной долей, от самых частых до самых редких. Частота букв — это классический первый шаг в анализе шифров: шифр Цезаря или простой замены выдает себя в тот момент, когда его распределение оказывается рядом с ожидаемым для языка. Эта же таблица так же полезна для задания по лингвистике: проверки того, действительно ли панграмма покрывает алфавит, балансировки плиток с буквами для игры в слова или быстрого ознакомления с набором данных перед его очисткой.

Игнорирование регистра включено по умолчанию, поэтому «E» и «e» делят одну строку; выключите его, чтобы разделить верхний и нижний регистр. Только буквы, также включенный по умолчанию, ограничивает таблицу буквенными символами. Выключите его, чтобы считать цифры, знаки препинания и пробелы — пробел отображается как ␣, а табуляция — как ⇥, поэтому их строки остаются видимыми. Сортируйте по количеству, чтобы увидеть, что доминирует в тексте, или по алфавиту, чтобы найти определенный символ. Столбец процентов показывает долю каждого символа во всем подсчитанном с точностью до одного десятичного знака.

Счет поддерживается Unicode: á, č, ő и ß являются самостоятельными буквами и имеют свои собственные строки, отдельные от a, c и o. Акцент, набранный как объединяющий знак, остается прикрепленным к его базовой букве, а если буквы отключены, смайлик считается одним символом, даже если технически он представляет собой последовательность из нескольких кодовых точек, как семейный смайлик.

Все работает в вашем браузере — текст никогда не загружается, поэтому черновики и конфиденциальные материалы можно безопасно вставлять. Скопируйте таблицу или загрузите ее в виде файла .txt.

FAQ

Считает ли он цифры, знаки препинания и пробелы?
Только если выключить «Только буквы». Затем в таблице перечислены все символы — цифры, знаки препинания, пробелы, обозначенные как ␣, и табуляции, обозначенные как ⇥. Разрывы строк никогда не учитываются, поэтому файл с окончаниями строк Windows дает тот же результат, что и файл с окончаниями Unix.
Считаются ли буквы с ударением отдельно от основной буквы?
Да. á, č, ő и ß — отдельные буквы, и каждая имеет свой ряд — á никогда не сворачивается в a. «Игнорировать регистр» объединяет только прописные и строчные буквы, поэтому Á присоединяется к á, а не к a. Акцент, набранный как отдельный знак объединения, сохраняется вместе с буквой и располагается в том же ряду, что и заранее составленный символ.
Как обрабатываются смайлы?
При включенном «Только буквы» они пропускаются. Если он отключен, каждый смайлик считается за один символ, включая флаги и семейные смайлы, которые технически состоят из нескольких объединенных вместе кодовых точек.
Мой текст где-нибудь загружен?
Нет. Инструмент полностью работает в вашем браузере, и ваш текст никогда не покидает ваше устройство.