多口音英语学习者口语语音库

来源 :第十届全国人机语音通讯学术会议 | 被引量 : 0次 | 上传用户:liongliong599
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
多口音英语学习者口语语音库(CELSCOM:Chinese EFLLearners speech corpus with multi-accents )旨在收集和建立中国不同方言区英语学习者的英语口语语音,一方面为英语语音识别提供 训练音库,另一方面为研究不用口音的英语与标准英语的语音特性的差异。本库在设计功能语句库录音文本时,将焦 点位置、词性、词重音位置等作为条件综合考虑,并且将口语化的篇章作为补充材料,为研究提供数据。本文着重介 绍功能语料库的设计原则、研究重点,以及对母语为普通话的英语学习者的英语语音库收集和标注规范,旨在对比功 能语句的不同韵律特征,并且简要介绍了初步发现及研究意义。
其他文献
中国地域辽阔,汉语包括多种方言。方言转换技术可实现方言间语音的转换,丰富语音交流的方式,增强语音交流的可懂性、友好性和趣味性。该文分析了普通话与沈阳方言在声调调类与调
会议
实际环境下,一个说话人识别系统的性能受到很多因素的影响,说话人自身发音方式的变化所引起的训练与识别语音的不匹配是其中很重要的一个方面。本文以一个含有多种发音方式变化
为满足言语工程需要,基于大规模语料库,选择了记叙文、说明文、议论文、新闻和专题五种朗读语体,在时长、音高方面对其重音特征进行分析。结果表明,各语体在总体特征、重音突显和
提出一种用于哼唱识别精确匹配的线性伸缩动态规划算法。该算法将哼唱旋律切割成句子,对每一句子进行线性伸缩匹配,同时在句子层次进行动态规划获得最优路径。该算法更有效地利用了哼唱语音的分段特性并克服了动态规划在长路径搜索时可能丢失全局最优路径的缺点。在含5 223首M ID I的数据库上同等条件下该算法正确率分别比线性伸缩、动态规划及递归匹配方法提高10.5%、6.0%和2.8%。该算法具有更高的准确率
语音情感识别领域提取情感特征时,普遍采用"不同情感类别,相同时长基准"的做法,忽略了人耳敏感的韵律段长会依情感不同而有所差异的现象。本文首先通过情感识别实验确定各类情感的最佳识别段长,作为人耳敏感韵律段长。并构造了基于韵律段特征的多重Elman网络模型,以期对不同情感基于特定敏感韵律段长进行识别和对多分类器识别结果进行有效融合,实现了对人耳情感辨识规律的模拟。结果表明,使用敏感韵律段特征的系统识别
随着军事、安全等方面要求的日益增长,语音信息隐藏技术成为了语音信号处理和信息安全领域的热点和难点,并得到了迅猛发展。本文将分数余弦变换应用到语音信息隐藏中,通过分析得
会议
本研究从透视乌鲁木齐维语与和田维语的韵律差异的角度来展示维语韵律的一些特点。在听感上,维族人很容易判断这两种维语方言,除了音段特征的不同外,韵律差异是区别的关键。但对
哼唱识别是音频检索的一个重要应用,其难点是音频歌曲数据的非结构性以及搜索速度和准确率平衡的问题。本文提出了新的数据库构造方法,将音频歌曲集用手工标注方法提取主旋律并
会议
The rapid variation of channel can induce the intercarrier interference in orthogonal frequency-division multiplexing (OFDM) systems. Intercarrier interference
针对传统的隐含马尔可夫模型(hidden Markov model ,HMM)存在的缺陷,该文提出了一种在识别的后处理阶段使用段长模型的方法,并应用在基于HMM的汉语识别系统上。该方法利用归一化