Sări la conținut

Generator de marcare SSML

Înfășurează textul simplu în etichete SSML valide pentru text-to-speech: pauze, accent, pronunție și ritm.

Intrare
Ieșire

Generator de marcare SSML

Lipiți textul simplu și acest instrument îl înfășoară în Speech Synthesis Markup Language (SSML) — dialectul XML pe care Amazon Polly, Google Cloud Text-to-Speech și Azure Speech îl folosesc pentru a controla modul în care vocile sintetizate citesc un script. Paragrafele devin elemente <p>, propozițiile devin elemente <s>, iar instrumentul inserează etichete <break> între ele, astfel încât ritmul este explicit în loc să fie lăsat la voia motorului.

Panoul de opțiuni controlează cât de mult marcaj este adăugat. Setați lungimea pauzei între propoziții și între paragrafe în milisecunde, și alegeți o viteză de vorbire și o tonalitate — valorile care nu sunt implicite înfășoară întreaga ieșire într-o etichetă <prosody>. Activați accentul pentru a converti cuvintele *marcate cu asterics* în <emphasis level="moderate">, și activați pronunția acronimelor pentru a înfășura secvențe în MAJUSCULE cum ar fi "NASA" în <say-as interpret-as="characters"> pentru a fi citite litera după litera în loc de a fi o cuvânt inventat. Un dicționar de pronunție personalizat vă permite să mapați cuvintele specifice la o înlocuire, redată fie ca o <sub alias="…"> înlocuire, fie ca un <phoneme alphabet="ipa" ph="…"> — util pentru nume, termeni de brand sau cuvinte pe care vocea implicită le pronunță incorect.

Setarea platformei țintă ajustează elementul rădăcină <speak>: Azure necesită o versiune, spațiu de nume și atribut xml:lang pe care Amazon Polly și Google Cloud TTS nu îi necesită, deci schimbarea platformelor schimbă doar acel wrapper. División propozițiilor este o euristică simplă bazată pe ./!/? — nu recunoaște abrevieri cum ar fi "Dr." ca non-terminatori, deci verificați ieșirea pe text cu multe abrevieri. Opțiunea "verificare validitate XML" verifică dacă marcajul generat este structural bine format (fiecare etichetă se închide corect) înainte de copiere.

Totul rulează local în browserul dvs. — textul dvs. nu este niciodată încărcat nicăieri. Când marcajul arată corect, copiați-l, descărcați-l ca fișier .txt, sau trimiteți ieșirea la intrarea altui instrument pentru a continua editarea.

FAQ

Ce motoare text-to-speech acceptă acest marcaj?
Ieșirea este SSML standard, înțeleasă de Amazon Polly, Google Cloud Text-to-Speech, Microsoft Azure Speech și majoritatea celorlalte motoare care implementează specificația SSML W3C. Opțiunea "Platformă țintă" doar schimbă elementul rădăcină pentru a se potrivi cu ceea ce așteptă fiecare serviciu.
Ce schimbă cu adevărat opțiunea de accent?
Înfășurați un cuvânt cu asterics în intrarea dvs., cum ar fi *niciodată*, și cu accentul activat devine <emphasis level="moderate">niciodată</emphasis> în ieșire — majoritatea motoarelor fac ca un cuvânt accentuat să sune puțin mai tare și mai lent.
De ce a fost "Dr." tratat ca sfârșit de propoziție?
División propozițiilor caută un punct, exclamație sau semn de întrebare urmat de spațiu alb — nu are o listă de abrevieri de omis, deci "Dr. Smith" este citit ca două propoziții scurte. Verificați ieșirea pe text cu multe abrevieri și ajustați punctuația dacă este necesar.
La ce servește dicționarul de pronunție?
Introduceți perechi cum ar fi brand=brand-name;NASA=N-A-S-A separate de puncte și virgule. Fiecare potrivire (fără sensibilitate la caz, cuvânt întreg) este înfășurată într-o etichetă <sub> sau <phoneme> în funcție de modul de etichetă pe care îl alegeți, deci motorul o citește cum ați specificat în loc să ghicească.
Este textul meu încărcat undeva?
Nu. Generatorul de marcare SSML rulează complet în browserul dvs. — textul dvs. nu pleacă niciodată de pe dispozitivul dvs.