本届竞赛新增以真实场景音频作为测试集的任务赛道和混合13种语言的“多语种语音识别”任务赛道。
在语种识别的开放赛道,测试集由17种语言覆盖视频会议、日常对话等10余个场景的真实环境音频和开源数据集两部分组成,这意味着本届OLR胜出队伍的模型将更贴近真实使用场景,环境鲁棒性更强,提前为模型吹响了实战的号角,以加速其适应真实世界交互的过程。
此次的多语种语音识别任务赛道突破了历届OLR仅识别语种的任务限制,参赛队伍的模型需要识别出多语种混合测试集的语音内容。这样的设置不仅出于实际应用需求的考虑,也为低资源数据识别训练提供了新的解题思路。
据悉,工业级语音识别系统通常需要上万甚至十万小时以上规模的标注数据,才能在特定场景达到90%以上的识别率,而诸如小语种等低资源数据获取难、标注难、评估难,已经成为了世界性难题。多语种语音识别,可通过对大语种模型的迁移学习或多语种共享特征学习弥补对低资源数据的依赖。
OLR2021由2个大赛道4个子任务组成,团队可自行选择参加,可多选,具体情况如下:

时间安排

*受疫情影响,研讨会与颁奖典礼将根据实际情况进行调整报名请发送以下内容至邮箱olr_challenge@163.com:5. (非必选项)参赛个人、参赛机构的网站页面或所发布的关于语音的论文。更多赛事相关信息,可至官网查看:http://cslt.riit.tsinghua.edu.cn/mediawiki/index.php/OLR_Challenge_2021关于INTERSPEECH2021 OLR Special Session国际语音顶会 INTERSPEECH 2021认可OLR 过去五年为全球语音领域做出的贡献,在投递论文达标后,通过了OLR主办方Special Session 的举办申请。
INTERSPEECH 2021 OLR Special Session 将于2021年8月30日-9月3日会议期间举行,线下会议地点为捷克的布尔诺,届时线上将同步开展,主要围绕OLR 2020的技术探讨交流,欢迎大家以任何形式参与!注册报名链接:https://www.interspeech2021.org/registrationOLR2021 & INTERSPEECH2021 OLR Special Session,期待您的参与!