You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用Azure文本转语音SSML调整句子中指定单词的重音

Azure语音服务SSML模拟单词重音的优化方案
  • 多参数组合调整prosody标签
    自然的单词重音不仅仅是音高提升,还伴随音量升高、语速略微放缓,同时调整这三个参数的效果比仅调整音高自然很多,参考示例:
This is a <prosody pitch="+20%" volume="+15%" rate="-10%">Test</prosody>

你可以根据使用的语音风格微调数值,正式播报类语音可以适当降低参数幅度,活泼类语音可以适当调高。

  • 用phoneme标签精准控制单词内部重音
    如果需要调整多音节单词内部的重音位置,直接指定音标的效果最好,不会出现整词语调生硬的问题,示例(将record的重音放在第二个音节):
<phoneme alphabet="ipa" ph="rɪˈkɔːd">record</phoneme>
  • 配合短停顿强化强调效果
    可以在需要强调的单词前后插入极短的停顿,让听众更容易捕捉到被强调的内容,参考示例:
This is a <break time="50ms"/><prosody pitch="+20%" volume="+15%" rate="-10%">Test</prosody><break time="50ms"/>

注意停顿时长不要超过100ms,否则会打断句子的流畅度。

注意:<emphasis>标签目前不在Azure语音服务的支持SSML元素范围内,添加后会被系统直接忽略,不建议使用。

内容的提问来源于stack exchange,提问作者fnx

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.24 00:15:08