2022年1月14日,由厦门大学、清华大学、海天瑞声、西北工业大学及昆山杜克大学联合主办,中国计算机学会语音对话与听觉专委会、中文信息学会协办的第六届“东方语种识别竞赛”(OLR2021)研讨会在线上成功召开。研讨会全程英文交流,由清华大学王东老师主持。在研讨会上,获奖队伍分享了各自竞赛系统的设计和改进经验,参会人员针对语种和语音识别的技术难点进行了一场酣畅淋漓的交流!


扫描下方二维码或点击文末阅读原文观看回放


14:30王东老师宣布研讨会开始,并对“东方语种识别竞赛”的发展和定位进行了简单介绍。


随后,洪青阳老师对本届竞赛进行了总结,介绍了本届竞赛的筹备情况,参赛队伍普遍使用的技术,比赛最终排名等内容。其中语种识别技术重点是采用ASR Encoder,然后迁移到语种模型,加上pooling层和语种分类层,再用语种数据进行finetune,优秀队伍的结果表明,这种方案可极大提升语种识别的性能,冠军队伍把EER从基线系统的8.977%降到0.2708%。而多语种语音识别比较有效的是采用LID判别语种类型+单语种语音识别(Hybrid或E2E架构),然后与E2E多语种语音识别结果融合,融合工具普遍采用ROVER;有部分队伍还加入了针对单语种的语言模型。本次竞赛结果表明,语种识别和多语种语音识别具有很强的互补性,两者之间如何进一步结合,非常值得深入研究。


在海天瑞声的市场部总监张楉林对OLR赛事的数据集进行了简单介绍后,来自昆山杜克大学的李明老师宣布了任务一与任务二获奖的队伍,来自西北工业大学的张晓雷老师宣布了任务三与任务四获奖的队伍。本届比赛最终排行榜如下所示。



紧接着,8支获奖队伍依次进行了技术分享。

第一支分享的队伍是来自蚂蚁集团的X-Voice,他们夺取了语种识别赛道的两个任务的第一名,分别是语种识别受限任务的第一名,语种识别开放任务的第一名。


第二支分享的队伍是来自爱沙尼亚塔林科技大学的TalTech,他们夺取了语种识别赛道的两个任务的第二名,分别是语种识别受限任务的第二名,语种识别开放任务的第二名。

第三支分享的队伍是来自北京云上曲率科技有限公司的funspeech,他们夺取了语种识别受限任务的第三名,语种识别开放任务的第四名,多语种语音识别受限任务的第六名。


第四支分享的队伍是来自网易(杭州) 易盾 AI Lab的nisp_speech,他们夺取了语种识别受限任务的第六名,语种识别开放任务的第三名,多语种语音识别受限任务的第五名,多语种语音识别开放任务的第五名。

第五支分享的队伍是来自的网易互娱AI Lab的CCDL,他们夺取了多语种语音识别赛道的两个第一名,分别是多语种语音识别受限任务的第一名和多语种语音识别开放任务的第一名。

第六支分享的队伍是来自北京理工大学的OLR_bit,他们夺取了语种识别受限任务的第八名,多语种语音识别受限赛道的第二名,多语种语音识别开放赛道的第三名。

第七支分享的队伍是来自核新同花顺网络信息股份有限公司的RoyalFlush,他们夺取了语种识别受限任务的第七名,语种识别开放任务的第六名,多语种语音识别受限任务的第三名,多语种语音识别开放任务的第四名。

最后分享的队伍是来自华为阿姆斯特丹研究院的Huawei_AMS,他们夺取了语种识别受限任务的第五名,多语种语音识别受限任务的第四名,多语种语音识别开放任务的第二名。

疫情并没有阻挡各位参会分享的热情。分享结束后,各队代表合影留念。

至此,本届研讨会圆满结束。本届竞赛数据由海天瑞声提供,竞赛的组织和研讨会的举办,得到洪青阳、李琳、王东等组委会老师的专业指导,特别感谢海天瑞声杨程,厦大语音实验室王彬玲、胡文轩、李静、王秋林、王峰等同学的辛苦付出!