1. 基本信息

是一种韩语语音识别 (ASR) 语种,由 2010 年至 2014 年在韩国举行的韩语 TEDx 会谈产生。它包含来自 41 个扬声器的大约 3 小时的语音音频脚本对。此语料库是使用称为 Pansori 的新语料库数据引入和处理系统生成的。语料库中包括的语音音频是 16 位 FLAC 文件,采样率为 16 KHz。

  1. 特点

只包括由社区翻译人员转录的TEDx讲座。

语种片段在字幕边界处被分割。

通过手动(工具辅助)语音文本对齐微调分段。

由最先进的语音识别器(Google 云语音到文本)进行最终验证。