Перейти до вмісту
100% локально

Очищувач розшифровки голосу

Очистіть необроблені стенограми перетворення мовлення в текст, видаливши слова-заповнювачі, заїкання та анотації.

Введення

Очищувач розшифровки голосу

Вставте необроблену розшифровку, експортовану з Whisper, Otter, системи розпізнавання мовлення Google або будь-якої іншої системи синтезу мовлення в текст, і цей інструмент перетворить приблизний машинний результат на читабельний текст. Він видаляє звуки вагань і слова-заповнювачі — «гм», «мм», «мм», «хм», «як», «ти знаєш», «я маю на увазі», «щось на кшталт» — разом із еквівалентами, які з’являються в словацькому, чеському, німецькому, польському та угорському диктанті, тому змішаний або неанглійський запис отримує таке ж очищення.

Прилади розпізнавання мовлення також мають тенденцію дослівно транскрибувати заїкання — «план», «я-я-я буду» — і опускати маркери в дужках у місцях втрати звуку, як-от [нерозбірливо], [музика] або (сміється). Обидва обробляються автоматично: повторювані слова згортаються до одного входження, а анотації в дужках зникають разом із зайвими пробілами, які вони залишають. Останній проход повторює першу літеру тексту та першу літеру після кожної крапки, знака питання та знаку оклику, оскільки транскрипції часто повертаються одним рядком слів у нижньому регістрі.

Кожен із п’яти кроків очищення — видалення заповнювачів, виправлення великих літер, згортання повторів, видалення анотацій у квадратних дужках і об’єднання окремих рядків у поточні абзаци — можна ввімкнути або вимкнути, тож ви можете зберегти оригінальні розриви рядків стенограми для роботи з субтитрами або об’єднати все в прозу для статті чи підсумку зустрічі. Підрахунок під результатом підраховує, скільки слів-заповнювачів і скільки повторюваних слів було видалено, тож ви можете одразу побачити, наскільки грубим був вихідний запис.

Усе працює локально у вашому браузері. Стенограма ніколи не залишає ваш пристрій, що важливо для записів зустрічей, інтерв’ю чи будь-чого іншого, що не призначене для стороннього сервера. Оскільки очищення працює на фіксованих списках слів і шаблонах, а не на справжньому розумінні мови, завжди проглядайте результат, перш ніж публікувати його — законне «подобається» або «ну» в середині речення може час від часу бути заповненим.

FAQ

Які слова-заповнювачі він видаляє?
Англійським набором є "um", "uh", "erm", "hmm", "like", "you know", "I mean" і "sort of"/"kind of", а також загальні еквіваленти словацького, чеського, німецького, польського та угорського диктанту, такі як "ehm", "hm", "no", "teda", "proste", "ako", "halt", "also" та "hat". Вимкніть опцію, щоб залишити кожне слово точно таким, як транскрибується.
Як він справляється із заїканням на зразок «Я-я-я піду»?
Слово, що повторюється безпосередньо — з дефісом або комою між повторами або без них — згортається до одного входження, тому «я-я-я піду» стає «я піду», а «план» стає «планом».
Що вважається анотацією в дужках?
Будь-що в квадратних або дужках, як-от [нерозбірливо], [музика] або (сміється) — тип маркера, який вставляє механізм перетворення мовлення в текст, коли він не може транскрибувати фрагмент аудіо. Якщо вимкнути опцію, вони зберігаються у виводі недоторканими.
Що робить «об’єднати рядки в абзаци»?
Експорт мовлення в текст часто розміщує кожен короткий сегмент в окремому рядку. Якщо ввімкнути це, рядки в кожному існуючому абзаці об’єднуються в речення, що витікають, тоді як порожній рядок у вихідній транскрипції все одно починає новий абзац у результаті.
Чи завантажено кудись мою стенограму?
Ні. Очищення повністю виконується у вашому браузері за допомогою вбудованих списків слів — стенограма ніколи не надсилається на сервер.