基于分割识别的蒙古语语音关键词检测方法的研究

飞龙; 高光来; 闫学亮; 王炜华

摘要

蒙古文属于黏着语,词根和后缀能够组合成近百万的蒙古文单词。现有的蒙古语大词汇量连续语音识别(LVCSR)系统的发音词典无法包含所有蒙古文单词。同时发音词典较大时,训练语料的稀疏将导致LVCSR系统的性能明显下降。为了解决LVCSR系统中大多数蒙古文单词的识别问题和蒙古语语音关键词检测系统中大量集外词的检测问题,结合蒙古文的构词特点,提出了基于分割识别的蒙古语LVCSR方法,并建立了对应的声学模型和语言模型。最后,将此方法应用到了蒙古语语音关键词检测系统中并在蒙古语语音语料上进行了测试。实验结果表明,基于分割识别的蒙古语LVCSR方法能解决大部分蒙古文单词的识别问题,并将蒙古语语音关键词检测系统...

出版日期2013
单位内蒙古大学

收藏分享被引浏览

更新时间：2019-07-18 21:09

基于分割识别的蒙古语语音关键词检测方法的研究

摘要

产品服务

站内浏览

服务支持

联系方式

科研之友