The First Chinese Auditory Attention Decoding Challenge


Challenge Website: http://www.iscslp2024.com/ChineseAAD


挑战与场景描述

A cocktail party is an interesting scene that manifests itself as the voices of multiple speakers mixed, as if at a raucous social 人脑的听觉系统具有强大的听觉感知能力,可以在复杂声学场景中只关注自己感兴趣的语音,同时忽略其他声音的干扰,这一现象被称为“鸡尾酒会问题”。近年来,基于脑电信号(EEG)的听觉注意解码(AAD)为鸡尾酒会问题提供了一种解决方案,它致力于在多说话者场景中从EEG信号中解码听者感兴趣的语音/空间方向。听觉注意解码的任务之一是通过分析听者的EEG来识别和定位多人说话环境中说话人的空间方位。由于现有的公开数据集都是在只有听觉刺激的场景中采集的受试者EEG数据,因此真实场景中的听觉注意通常伴随着视觉和听觉的同时输入。我们提供了一个AHU数据集,该数据集由共20名受试者在audio-only场景(audio-video场景)中收集的脑电图数据组成,这些受试者在双说话人刺激下平均收听40分钟,总计约13.3小时的数据。在中文听觉注意解码挑战赛中,团队将竞争建立最佳深度学习模型,从EEG信号中分析受试者关注的说话人空间方向(左/右,0/1)。


赛道

赛道1. 单受试者(single-subject,SS):包括audio-only任务和audio-video任务。每个受试者的数据按照8:1:1的比例分为训练、验证和测试。参与者的目标是建立一个单受试者解码模型,计算每个受试者在测试集上的准确率,最终得到一个平均解码准确率(%)。
    赛道1.1. audio-only任务(SS-AO):在纯音频场景中,8个受试者的平均解码准确率(%)。
    赛道1.2. audio-video任务(SS-AV):在音视频场景中,8个受试者的平均解码准确率(%)。
赛道2. 跨受试者(cross-subject,CS):包括audio-only任务和audio-video任务。每个场景提供8个受试者的数据用于训练和验证,2个用于测试。参与者的目标是建立一个跨受试者的解码模型,计算测试集中每个受试者的解码准确率,最终得到平均解码准确率(%)。
    赛道2.1 audio-only任务(CS-AO):在纯音频场景中,2个受试者的平均解码准确率(%)。
    赛道2.2 audio-video任务(CS-AV)在音视频场景中,2个受试者的平均解码准确率(%)。


推荐论文及奖励的规则

1. 这个挑战赛有两个独立的任务。参与者可以参加一个赛道或两个赛道。结果应附有一篇描述所建议方法的论文。

2. 排名前5位的团队将被邀请提交一篇论文,并在ISCSLP-2024上发表。

3. 前5名队伍的决定如下:第1赛道的前2名队伍和第2赛道的前2名队伍。提交结果最多赛道中成绩为第三名的队伍被选为第五名队伍。

4.为获奖选手提供荣誉证书。


中文AAD挑战赛的时间表

21 May 2024: Release of the baseline system, Train and Eval data.

2024年5月21日:发布基线系统、训练和验证数据。

2024年6月20日:报名截止日期,参与者参加挑战赛的截止日期。

2024年7月4日:发布测试数据。

2024年7月6日:最终提交截止日期。

2024年7月8日:公布结果和排名。


组织者

范存航,安徽大学

吕钊,安徽大学

蔡思祺,新加坡国立大学

卢晶,南京大学声学研究所


有关挑战赛的详细资料,请参阅网页:http://www.iscslp2024.com/ChineseAAD

如二维码过期,可添加微信:zyd949