Preskoči na sadržaj
100% lokalno

Čistač glasovnog prijepisa

Očistite neobrađene prijepise govora u tekst uklanjanjem riječi za popunjavanje, zastajkivanja i napomena.

Unos
Rezultat

Čistač glasovnog prijepisa

Zalijepite neobrađeni prijepis izvezen iz Whispera, Ottera, Googleovog prepoznavanja govora ili bilo kojeg drugog mehanizma za pretvaranje govora u tekst, a ovaj alat grubi strojni izlaz pretvara u čitljiv tekst. Uklanja zvukove oklijevanja i dodatne riječi — "hm", "uh", "hmm", "hmm", "kao", "znaš", "mislim", "nekako" — zajedno s ekvivalentima koji se pojavljuju u slovačkom, češkom, njemačkom, poljskom i mađarskom diktatu, tako da mješovita ili neengleska snimka dobiva isto čišćenje.

Prepoznavači govora također imaju tendenciju doslovno transkribirati mucanje — "plan", "ja- ja- hoću" — i ispuštaju markere u zagradama tamo gdje su izgubili zvuk, poput [nečujno], [glazba] ili (smijeh). Oba se obrađuju automatski: ponovljene riječi sažimaju se u jedno pojavljivanje, a bilješke u zagradama nestaju zajedno s dodatnim razmakom koji ostavljaju iza sebe. Završni prolaz rekapitalizira prvo slovo teksta i prvo slovo nakon svake točke, upitnika i uskličnika, budući da se transkripti često vraćaju u jednom nizu riječi malim slovima.

Svaki od pet koraka čišćenja — uklanjanje ispuna, ispravljanje velikih slova, sažimanje ponavljanja, izbacivanje napomena u zagradama i spajanje zasebnih redaka u tekuće odlomke — može se uključiti ili isključiti, tako da možete zadržati izvorne prijelome redaka prijepisa za rad s podnaslovima ili stopiti sve u prozu za članak ili sažetak sastanka. Zbroj ispod ispisa broji koliko je riječi za popunjavanje i koliko ponovljenih riječi uklonjeno, tako da možete na prvi pogled vidjeti koliko je originalna snimka bila gruba.

Sve radi lokalno u vašem pregledniku. Transkript nikada ne napušta vaš uređaj, što je važno za snimke sastanaka, intervjue ili bilo što drugo što nije namijenjeno poslužitelju treće strane. Budući da čišćenje radi na fiksnim popisima riječi i obrascima, a ne na pravom razumijevanju jezika, uvijek letimično pregledajte rezultat prije nego što ga objavite — legitimno "sviđa mi se" ili "dobro" usred rečenice može povremeno biti pometeno s dopunama.

FAQ

Koje riječi za popunjavanje uklanja?
Engleski skup je "um", "uh", "erm", "hmm", "like", "you know", "mislim" i "sort of"/"kind of", plus uobičajeni ekvivalenti iz slovačkog, češkog, njemačkog, poljskog i mađarskog diktata kao što su "ehm", "hm", "no", "teda", "proste", "ako", "halt", "also" i "hat". Isključite opciju da svaka riječ ostane točno onako kako je transkribirana.
Kako podnosi mucanje poput "ja- ja- ja ću ići"?
Odmah ponovljena riječ — sa ili bez crtice ili zareza između ponavljanja — sažima se u jedno pojavljivanje, tako da "ja- ja- ja ću ići" postaje "ja ću ići", a "plan" postaje "plan".
Što se računa kao napomena u zagradama?
Bilo što unutar uglatih zagrada ili zagrada, kao što je [nečujno], [glazba] ili (smijeh) — vrsta oznake koju motor za pretvaranje govora u tekst umeće kada ne može transkribirati dio zvuka. Isključivanjem opcije oni ostaju u izlazu netaknuti.
Što radi "spojiti retke u odlomke"?
Izvoz govora u tekst često stavlja svaki kratki segment u zaseban red. Omogućavanjem ove opcije spajaju se reci unutar svakog postojećeg odlomka u tekuće rečenice, dok prazan redak u izvornom prijepisu i dalje započinje novi odlomak u rezultatu.
Je li moj transkript igdje učitan?
Ne. Čišćenje se u potpunosti izvodi u vašem pregledniku pomoću ugrađenih popisa riječi — prijepis se nikada ne šalje na poslužitelj.