Przejdź do treści
100% lokalnie

Czyszczenie transkrypcji głosu

Oczyść nieprzetworzone transkrypcje mowy na tekst, usuwając słowa wypełniające, zacięcia i adnotacje.

Wejście
Wynik

Czyszczenie transkrypcji głosu

Wklej surową transkrypcję wyeksportowaną z Whisper, Otter, mechanizmu rozpoznawania mowy Google lub dowolnego innego mechanizmu zamiany mowy na tekst, a to narzędzie zamieni przybliżony wynik maszynowy na czytelny tekst. Usuwa dźwięki wahania i słowa wypełniające – „um”, „uh”, „erm”, „hmm”, „jak”, „wiesz”, „mam na myśli”, „w pewnym sensie” – wraz z odpowiednikami, które pojawiają się w słowackim, czeskim, niemieckim, polskim i węgierskim dyktandzie, więc nagranie mieszane lub nieanglojęzyczne jest tak samo czyszczone.

Osoby rozpoznające mowę mają także tendencję do dosłownej transkrypcji zacięć — „planu”, „ja-ja-ja” – i upuszczania znaczników w nawiasach w miejscach, w których utraciły dźwięk, np. [niesłyszalne], [muzyka] lub (śmiech). Obydwa są obsługiwane automatycznie: powtarzające się słowa zwijają się w pojedyncze wystąpienie, a adnotacje w nawiasach znikają wraz z pozostawionymi przez nie dodatkowymi odstępami. W końcowym przebiegu następuje powtórzenie pierwszej litery tekstu i pierwszej litery po każdej kropce, znaku zapytania i wykrzykniku, ponieważ transkrypcje często wracają w jednym ciągu małych liter.

Każdy z pięciu etapów czyszczenia — usuwanie wypełniaczy, poprawianie wielkich liter, zwijanie powtórzeń, usuwanie adnotacji w nawiasach i łączenie oddzielnych wierszy w płynne akapity — można włączyć lub wyłączyć, dzięki czemu można zachować oryginalne podziały wierszy transkrypcji na potrzeby napisów lub połączyć wszystko w prozę do artykułu lub podsumowania spotkania. Wynik pod wynikami pokazuje, ile słów wypełniających i ile słów powtarzających się zostało usuniętych, dzięki czemu można na pierwszy rzut oka zobaczyć, jak szorstkie było oryginalne nagranie.

Wszystko działa lokalnie w Twojej przeglądarce. Transkrypcja nigdy nie opuszcza Twojego urządzenia, co ma znaczenie w przypadku nagrań spotkań, wywiadów lub czegokolwiek innego, co nie było przeznaczone dla serwera strony trzeciej. Ponieważ czyszczenie działa na ustalonych listach i wzorcach słów, a nie na prawdziwym rozumieniu języka, zawsze przeglądaj wynik przed jego opublikowaniem — uzasadnione „lubię to” lub „dobrze” w środku zdania może czasami zostać wypełnione wypełniaczami.

Częste pytania

Jakie słowa wypełniające usuwa?
Zestaw angielski to „um”, „uh”, „erm”, „hmm”, „jak”, „wiesz”, „mam na myśli” i „rodzaj”/„rodzaj” oraz popularne odpowiedniki dyktando słowackiego, czeskiego, niemieckiego, polskiego i węgierskiego, takie jak „ehm”, „hm”, „no”, „teda”, „proste”, „ako”, „halt”, „also” i „hat”. Wyłącz opcję, aby pozostawić każde słowo dokładnie w takiej formie, w jakiej zostało przepisane.
Jak radzi sobie z jąkaniem typu „Ja-ja-pójdę”?
Natychmiast powtórzone słowo — z łącznikiem lub przecinkiem między powtórzeniami lub bez — jest zwijane do pojedynczego wystąpienia, więc „Ja-ja-pójdę” staje się „pójdę”, a „plan” staje się „planem”.
Co liczy się jako adnotacja w nawiasach?
Wszystko, co znajduje się w nawiasach kwadratowych lub nawiasach, na przykład [niesłyszalne], [muzyka] lub (śmiech) — rodzaj znacznika wstawianego przez silnik zamiany mowy na tekst, gdy nie może dokonać transkrypcji fragmentu dźwięku. Wyłączenie tej opcji powoduje, że pozostają one na wyjściu nietknięte.
Co robi „scal wiersze w akapity”?
Eksporty mowy na tekst często umieszczają każdy krótki segment w osobnym wierszu. Włączenie tej opcji powoduje połączenie wierszy każdego istniejącego akapitu w ciągłe zdania, podczas gdy pusta linia w oryginalnym transkrypcie nadal rozpoczyna nowy akapit w wyniku.
Czy mój zapis jest gdzieś przesłany?
Nie. Oczyszczanie odbywa się całkowicie w przeglądarce przy użyciu wbudowanych list słów — transkrypcja nigdy nie jest wysyłana na serwer.