Частотомір літер
Підрахуйте, як часто кожна літера з’являється в тексті, у кількості та відсотках.
Частотомір літер
Вставте будь-який текст і отримайте таблицю його символів, кожен із кількістю та відсотковою часткою, упорядкованих від найчастіших до найрідкісніших. Частота літер є класичним першим кроком у аналізі шифру — шифр Цезаря або простий замінний шифр видає себе в той момент, коли його розподіл стає поряд із очікуваним для мови. Та сама таблиця також корисна для завдання з лінгвістики, щоб перевірити, чи справді панграма охоплює алфавіт, збалансувати плитки літер для гри слів або отримати швидке відчуття набору даних перед його очищенням.
Ігнорувати регістр увімкнено за замовчуванням, тому "E" та "e" мають один рядок; вимкніть його, щоб розділити великі та малі літери. Лише літери, також увімкнено за замовчуванням, обмежує таблицю символами алфавіту. Вимкніть його, щоб також підраховувати цифри, знаки пунктуації та пробіли — пробіл відображається як ␣, а вкладка як ⇥, тому їхні рядки залишаються видимими. Сортуйте за кількістю, щоб побачити, що домінує в тексті, або за алфавітом, щоб знайти певний символ. Стовпець у відсотках показує частку кожного символу від усього підрахованого з точністю до одного знака після коми.
Підрахунок здійснюється з урахуванням Юнікоду: á, č, ő і ß є окремими літерами та мають власні рядки, окремі від a, c та o. Наголос, введений як об’єднувальний знак, залишається приєднаним до основної літери, а якщо лише літери вимкнено, емодзі вважається одним символом, навіть якщо технічно це послідовність кількох кодових точок, як сімейні емодзі.
Усе працює у вашому браузері — текст ніколи не завантажується, тому чернетки та конфіденційні матеріали безпечно вставляти. Скопіюйте таблицю або завантажте її як файл .txt.