Saltar al contenido
Totalmente local

Limpiador de transcripción de voz

Limpie las transcripciones de voz a texto sin procesar eliminando palabras de relleno, tartamudeos y anotaciones.

Entrada

Limpiador de transcripción de voz

Pegue una transcripción sin procesar exportada desde Whisper, Otter, el reconocimiento de voz de Google o cualquier otro motor de conversión de voz a texto, y esta herramienta convertirá la salida aproximada de la máquina en texto legible. Elimina los sonidos de vacilación y las palabras de relleno - "um", "uh", "erm", "hmm", "like", "ya sabes", "quiero decir", "más o menos" - junto con los equivalentes que aparecen en el dictado en eslovaco, checo, alemán, polaco y húngaro, por lo que una grabación mixta o en otro idioma obtiene la misma limpieza.

Los reconocedores de voz también tienden a transcribir los tartamudeos literalmente: "el plan", "yo-yo-lo haré" y colocan marcadores entre corchetes donde perdieron el audio, como [inaudible], [música] o (risas). Ambos se manejan automáticamente: las palabras repetidas colapsan en una sola aparición y las anotaciones entre corchetes desaparecen junto con el espacio adicional que dejan. Una pasada final recapitaliza la primera letra del texto y la primera letra después de cada punto, signo de interrogación y signo de exclamación, ya que las transcripciones a menudo aparecen en una sola serie de palabras en minúscula.

Cada uno de los cinco pasos de limpieza (eliminar rellenos, corregir las mayúsculas, contraer repeticiones, eliminar anotaciones entre corchetes y fusionar líneas separadas en párrafos fluidos) se puede activar o desactivar, de modo que pueda conservar los saltos de línea originales de una transcripción para el trabajo de subtítulos o fusionar todo en prosa para un artículo o resumen de una reunión. El recuento debajo del resultado cuenta cuántas palabras de relleno y cuántas palabras repetidas se eliminaron, para que pueda ver de un vistazo qué tan tosca fue la grabación original.

Todo se ejecuta localmente en su navegador. La transcripción nunca sale de su dispositivo, lo cual es importante para grabaciones de reuniones, entrevistas o cualquier otra cosa que no esté destinada a un servidor de terceros. Debido a que la limpieza funciona con listas y patrones de palabras fijos en lugar de con una comprensión genuina del lenguaje, siempre lea el resultado antes de publicarlo: un "me gusta" o "bien" legítimo en medio de una oración ocasionalmente puede quedar arrastrado por los rellenos.

Preguntas frecuentes

¿Qué palabras de relleno elimina?
El conjunto en inglés es "um", "uh", "erm", "hmm", "like", "you know", "I sign of" y "sort of"/"kind of", además de equivalentes comunes del dictado eslovaco, checo, alemán, polaco y húngaro como "ehm", "hm", "no", "teda", "proste", "ako", "halt", "also" y "hat". Desactive la opción para dejar cada palabra exactamente como está transcrita.
¿Cómo maneja tartamudeos como "Yo-yo-yo iré"?
Una palabra que se repite inmediatamente (con o sin guión o coma entre las repeticiones) se contrae en una sola aparición, por lo que "I-I-Iré" se convierte en "Iré" y "el plan" se convierte en "el plan".
¿Qué cuenta como una anotación entre corchetes?
Cualquier cosa que esté entre corchetes o paréntesis, como [inaudible], [música] o (risas), el tipo de marcador que inserta un motor de conversión de voz a texto cuando no puede transcribir un tramo de audio. Desactivar la opción los mantiene intactos en la salida.
¿Qué hace "fusionar líneas en párrafos"?
Las exportaciones de voz a texto a menudo colocan cada segmento corto en su propia línea. Al habilitar esto, se unen las líneas dentro de cada párrafo existente en oraciones fluidas, mientras que una línea en blanco en la transcripción original aún comienza un nuevo párrafo en el resultado.
¿Mi transcripción está cargada en algún lugar?
No. La limpieza se ejecuta completamente en su navegador mediante listas de palabras integradas; la transcripción nunca se envía a un servidor.