基于静音时长和文本特征融合的韵律边界自动标注

傅睿博; 陶建华; 李雅; 温正棋

doi:10.16511/j.cnki.qhdxxb.2018.21.003

摘要

韵律边界标注对于语料库建设和语音合成有着至关重要的作用,而自动韵律标注可以克服人工标注中耗时、不一致的缺点。仿照人工标注流程,该文运用循环神经网络分别对文本和音频两个通道训练子模型,对子模型的输出采用模型融合的方法,从而获得最优标注。以词为单位提取了静音时长,与传统以帧为单位的声学特征相比更具有明确的物理意义,与韵律边界的联系更加紧密。实验结果表明:相比传统声学特征,该文所采用的静音时长特征使自动韵律标注的性能有所提高;相比直接特征层面的方法,决策融合方法更好地结合了声学和文本的特征,进一步提高了标注的性能。

单位
中国科学院大学; 中国科学院自动化研究所; 模式识别国家重点实验室

全文

访问全文

收藏分享被引浏览

更新时间：2024-04-25 02:07

基于静音时长和文本特征融合的韵律边界自动标注

摘要

全文

产品服务

站内浏览

服务支持

联系方式

科研之友