Буквенный частотомер
Подсчитайте, как часто каждая буква встречается в тексте, используя количество и проценты.
Буквенный частотомер
Вставьте любой текст и получите таблицу его символов, каждый со своим количеством и процентной долей, от самых частых до самых редких. Частота букв — это классический первый шаг в анализе шифров: шифр Цезаря или простой замены выдает себя в тот момент, когда его распределение оказывается рядом с ожидаемым для языка. Эта же таблица так же полезна для задания по лингвистике: проверки того, действительно ли панграмма покрывает алфавит, балансировки плиток с буквами для игры в слова или быстрого ознакомления с набором данных перед его очисткой.
Игнорирование регистра включено по умолчанию, поэтому «E» и «e» делят одну строку; выключите его, чтобы разделить верхний и нижний регистр. Только буквы, также включенный по умолчанию, ограничивает таблицу буквенными символами. Выключите его, чтобы считать цифры, знаки препинания и пробелы — пробел отображается как ␣, а табуляция — как ⇥, поэтому их строки остаются видимыми. Сортируйте по количеству, чтобы увидеть, что доминирует в тексте, или по алфавиту, чтобы найти определенный символ. Столбец процентов показывает долю каждого символа во всем подсчитанном с точностью до одного десятичного знака.
Счет поддерживается Unicode: á, č, ő и ß являются самостоятельными буквами и имеют свои собственные строки, отдельные от a, c и o. Акцент, набранный как объединяющий знак, остается прикрепленным к его базовой букве, а если буквы отключены, смайлик считается одним символом, даже если технически он представляет собой последовательность из нескольких кодовых точек, как семейный смайлик.
Все работает в вашем браузере — текст никогда не загружается, поэтому черновики и конфиденциальные материалы можно безопасно вставлять. Скопируйте таблицу или загрузите ее в виде файла .txt.