🚀 Emilia-Large核心亮点?

自初代 Emilia 数据集发布以来,全球已有超过700家顶尖机构与实验室申请使用,累计下载量突破15万次!
今天,我们正式推出全新升级的Emilia-Large数据集,带来以下三大核心提升:
1️⃣数据总量大幅提升:在原有 Emilia101k小时数据的基础上,新增 Emilia-YODAS114k小时的全新数据,开源总量突破200k小时,再次刷新开源 TTS 数据集的规模上限!
2️⃣小语种数据显著扩充:增加更多德语、法语、韩语等低资源语言数据,TTS 技术不再局限于中英文,助力全球多语言应用!
3️⃣商业化限制放宽:原 Emilia 数据集基于 CC-BY-NC 协议,而新增的 Emilia-YODAS 数据基于 CC-BY 协议,全面支持各类商业化应用,赋能更多创新场景!


图:Emilia-Large 的数据分布


除了数据本身的升级,我们在相关论文中深入探讨了以下研究问题:

👉In-the-wild 数据与传统有声书数据的优势对比
👉数据规模与TTS性能之间的关系
👉多语言(multilingual)与跨语言(crosslingual)TTS的效果比较
Emilia-Large数据集的发布,标志着我们在 TTS 领域的技术开放与共享迈出了重要一步。我们期待与全球开发者携手,共同推动语音技术的进步与普及,赋能更多创新应用场景!


🔗 快速获取(HuggingFace 仓库)

  • 已授权用户:曾申请过 Emilia 权限的研究者,可直接访问原仓库下载 Emilia-YODAS,无需重复申请!
  • 新用户:访问 HuggingFace 页面,按 README 指引提交申请。


🎧技术资源