DCAI
← 返回全部动态
arXiv 自然语言处理AI 评分 65/10009月25日 12:00

孟加拉语长文本语音合成数据集BanglaKontho发布

针对孟加拉语在神经文本转语音(TTS)领域缺乏高质量长文本朗读资源的现状,研究人员推出了BanglaKontho数据集。该数据集源自专业有声读物录音,包含20小时单人发音数据、7050条经转写校验的24 kHz切分片段,旨在解决现有语料缺乏长文本韵律与连贯叙述的问题。此外,研究团队还发布了支持孟加拉风格数字分组、货币与日期表达的文本正则化工具。

推荐理由填补了世界第七大语言孟加拉语在长文本神经语音合成领域的高质量专业有声读法语料空白。

原标题:BanglaKontho: Closing the Long-Form Gap in Bangla Text-to-Speech

阅读 arXiv 自然语言处理 原文 ↗