Ir para o conteúdo
Totalmente local

Limpador de transcrição de voz

Limpe as transcrições brutas de fala para texto removendo palavras de preenchimento, falhas e anotações.

Entrada
Saída

Limpador de transcrição de voz

Cole uma transcrição bruta exportada do Whisper, Otter, reconhecimento de fala do Google ou qualquer outro mecanismo de conversão de fala em texto, e esta ferramenta transforma a saída bruta da máquina em texto legível. Ele elimina sons de hesitação e palavras de preenchimento - "um", "uh", "erm", "hmm", "gosto", "você sabe", "quero dizer", "mais ou menos" - junto com os equivalentes que aparecem no ditado eslovaco, tcheco, alemão, polonês e húngaro, para que uma gravação mista ou em outro idioma não inglês receba a mesma limpeza.

Os reconhecedores de fala também tendem a transcrever gagueiras literalmente - "o plano", "Eu- eu- eu vou" - e colocar marcadores entre colchetes onde perderam o áudio, como [inaudível], [música] ou (risos). Ambos são tratados automaticamente: palavras repetidas são reduzidas a uma única ocorrência e as anotações entre colchetes desaparecem junto com o espaçamento extra que deixam para trás. Uma passagem final recapitaliza a primeira letra do texto e a primeira letra após cada ponto final, ponto de interrogação e ponto de exclamação, uma vez que as transcrições geralmente retornam em uma única sequência de palavras minúsculas.

Cada uma das cinco etapas de limpeza – remover preenchimentos, corrigir letras maiúsculas, recolher repetições, descartar anotações entre colchetes e mesclar linhas separadas em parágrafos fluidos – pode ser ativada ou desativada, para que você possa manter as quebras de linha originais de uma transcrição para o trabalho de legendas ou mesclar tudo em prosa para um artigo ou resumo de reunião. A contagem abaixo da saída conta quantas palavras de preenchimento e quantas palavras repetidas foram removidas, para que você possa ver rapidamente o quão difícil era a gravação original.

Tudo é executado localmente no seu navegador. A transcrição nunca sai do seu dispositivo, o que é importante para gravações de reuniões, entrevistas ou qualquer outra coisa que não seja destinada a um servidor de terceiros. Como a limpeza funciona em listas e padrões fixos de palavras, em vez de compreensão genuína da linguagem, sempre dê uma olhada no resultado antes de publicá-lo - um "curtir" ou "bem" legítimo no meio de uma frase pode ocasionalmente ser varrido pelos preenchimentos.

FAQ

Quais palavras de preenchimento ele remove?
O conjunto em inglês é "um", "uh", "erm", "hmm", "like", "you know", "I mean" e "sort of"/"kind of", além de equivalentes comuns do ditado eslovaco, tcheco, alemão, polonês e húngaro, como "ehm", "hm", "no", "teda", "proste", "ako", "halt", "also" e "hat". Desative a opção para deixar cada palavra exatamente como transcrita.
Como ele lida com gagueiras como "Eu-eu-eu irei"?
Uma palavra imediatamente repetida - com ou sem hífen ou vírgula entre as repetições - é reduzida a uma única ocorrência, então "eu-eu-eu irei" torna-se "eu irei" e "o plano" torna-se "o plano".
O que conta como uma anotação entre colchetes?
Qualquer coisa entre colchetes ou parênteses, como [inaudível], [música] ou (risos) — o tipo de marcador que um mecanismo de conversão de fala em texto insere quando não consegue transcrever um trecho de áudio. Desativar a opção os mantém intactos na saída.
O que "mesclar linhas em parágrafos" faz?
As exportações de voz para texto geralmente colocam cada segmento curto em sua própria linha. Ativar isso une as linhas de cada parágrafo existente em frases fluidas, enquanto uma linha em branco na transcrição original ainda inicia um novo parágrafo no resultado.
Minha transcrição é carregada em algum lugar?
A limpeza é executada inteiramente no seu navegador usando listas de palavras integradas — a transcrição nunca é enviada para um servidor.