Hoppa till innehåll

SSML-märkspråksgenerator

Konvertera vanlig text till giltiga SSML-taggar: pauser, betoning, uttal och talhastighet.

Inmatning
Utmatning

SSML-märkspråksgenerator

Klistra in vanlig text och det här verktyget omsluter det i Speech Synthesis Markup Language (SSML) — det XML-dialekt som Amazon Polly, Google Cloud Text-to-Speech och Azure Speech använder för att styra hur syntetiserade röster läser ett manus. Stycken blir <p>-element, meningar blir <s>-element och verktyget infogar <break>-taggar mellan dem så att tidpunkten är explicit istället för att lämnas till motorns gissning.

Alternativpanelen kontrollerar hur mycket markup som läggs till. Ställ in pauslängden mellan meningar och mellan stycken i millisekunder och välj en talhastighet och tonhöjd — värden som inte är standard omsluter hela utdata i en <prosody>-tagg. Aktivera betoning för att konvertera *märkta* ord till <emphasis level="moderate">, och aktivera akronymstavning för att omsluta VERSALER som "NASA" i <say-as interpret-as="characters"> så att de läses bokstav för bokstav istället för som ett påhittat ord. En anpassad uttalslexikon låter dig mappa specifika ord till en ersättning, återgiven som antingen en <sub alias="…">-ersättning eller en <phoneme alphabet="ipa" ph="…"> — användbar för namn, varumärkestermer eller ord som standardrösten uttalar felaktigt.

Inställningen för målplattform justerar <speak>-elementet: Azure behöver version-, namespace- och xml:lang-attribut som Amazon Polly och Google Cloud TTS inte kräver, så att byta plattform ändrar bara den omslutningen. Meningssplitning är en enkel heuristik baserad på ./!/? — den känner inte igen förkortningar som "Dr." som icke-terminatorer, så kontrollera utdata på text med många förkortningar. Alternativet "Kontrollera XML-giltighet" verifierar att den genererade koden är strukturellt välformad.

Allt körs lokalt i din webbläsare — ditt manus laddas aldrig upp någonstans. När markeringen ser rätt ut kopierar du den, laddar ner den som en .txt-fil eller skickar utdata till en annan verktygs inmatning för att fortsätta redigera.

FAQ

Vilka text-till-tal-motorer accepterar denna märkning?
Utdata är standard SSML, förstådd av Amazon Polly, Google Cloud Text-to-Speech, Microsoft Azure Speech och de flesta andra motorer som implementerar W3C SSML-specifikationen. Inställningen "Målplattform" ändrar bara rotelementet för att matcha vad varje tjänst förväntar.
Vad ändrar betoning-alternativet exakt?
Omslut ett ord med asterisker i din inmatning, som *aldrig*, och med betoning aktiverat blir det <emphasis level="moderate">aldrig</emphasis> i utdata — de flesta motorer gör ett betonat ord något högre och långsammare.
Varför behandlades 'Dr.' som slutet på en mening?
Meningssplitning letar efter en period, utropstecken eller frågetecken följt av blanksteg — det har ingen lista över förkortningar att hoppa över, så "Dr. Smith" läses som två korta meningar. Granska utdata för text med många förkortningar och justera interpunktionen efter behov.
Vad är uttalslexikonet till för?
Ange par som varumärke=varumärkes namn;NASA=N-A-S-A åtskilda av semikolon. Varje matchning (skiftlägesokänslig, helt ord) är omsluten av en <sub>- eller <phoneme>-tagg beroende på vilket taggläge du väljer, så motorn läser det på det sätt du anger istället för att gissa.
Laddas mitt skript upp någonstans?
Nej. SSML-märkspråksgeneratorn körs helt i din webbläsare — din text lämnar aldrig din enhet.