清华大学语音和语言技术中心(CSLT)在语音开源平台 Kaldi 上公布了中国明星声纹数据集 CN-Celeb 的说话人识别基础流程(Recipe)。研究者可以依此流程构建属于自己的说话人识别系统。


中国明星声纹库 CN-Celeb
CN-Celeb 是由清华大学语音和语言技术中心(CSLT)近日公布的一个中国明星声纹库。项目组成员包括实习生范悦、亢嘉文、李开诚、陈浩林、程思潼、张鹏远、周子雅等(指导老师王东、李蓝天、蔡云麒)。该声纹库包含1,000名中国明星(包括歌星、影星、说唱艺人等)在采访、歌舞及影视作品中的声音片段。每位明星的声音时长大约20分钟,整个数据集近300小时。该数据包含了11类实际场景,覆盖了噪音、信道、发音方式等各方面的复杂性,特别适合研究复杂场景下的说话人识别技术。研究者可在共享资源网站http://openslr.org搜索 CN-Celeb 免费下载。


CN-Celeb 项目组实习生


CN-Celeb Kaldi Recipe

Kaldi 是语音领域最活跃的开源平台,由著名学者 Dan Povey 发起并维护,吸引了众多研究者参与开发。目前,Kaldi 中已经有语音识别、说话人识别、语种识别等标准 Recipe 近90个。基于 CN-Celeb 数据库,清华大学 CSLT(实习生亢嘉文,指导老师李蓝天)近日提交了一份说话人识别 Recipe,并于今日 Merge 到 Main Branch 中。这是第一份中文说话人识别的 Kaldi Recipe。研究者可以通过下载最新的 Kaldi 系统进行实验验证。



基于 CN-Celeb 的 Kaldi Recipe


资源获取
  • CN-Celeb 项目网址

    • http://cslt.riit.tsinghua.edu.cn/mediawiki/index.php/CN-Celeb

  • CN-Celeb 论文地址

    • https://arxiv.org/abs/1911.01799

  • CN-Celeb 下载地址

    • CSLT@Tsinghua University:

      http://cslt.riit.tsinghua.edu.cn/~data/CN-Celeb/

    • OpenSLR:

      http://www.openslr.org/82/

  • Kaldi Recipe 地址

    • https://github.com/kaldi-asr/kaldi/tree/master/egs/cnceleb