我的资源
共 246 个数据集
MS-微软语音语料库(印度语)
语音识别印度语
MS-微软语音语料库(印度语)

Microsoft Speech Corpus(印度语言)发行版包含泰卢固语、泰米尔语和古吉拉特语的会话和短语语音训练和测试数据

3 下载 · 0 赞获取 →
微软Frames帧数据集
对话数据
微软Frames帧数据集

Frames正是为了鼓励对对话代理的研究,这些代理可以支持复杂环境中的决策,在这种情况下,预订假期包括航班和酒店。

1 下载 · 0 赞获取 →
淘宝客服对话数据集
Speech Recognition
淘宝客服对话数据集

淘宝公开的客服对话语料库,其中包括一个训练数据集,一个验证集和一个测试集,可用于基于检索的聊天机器人开发研究。

0 下载 · 0 赞获取 →
Twitter情感文本数据集
Emotion Recognition
Twitter情感文本数据集

Twitter情感文本数据集

0 下载 · 0 赞获取 →
COVID-19医学对话数据集
医疗对话
COVID-19医学对话数据集

数据集是有关COVID-19和其他类型肺炎的医学对话数据集,内容为患者担心自己可能被COVID-19或其他肺炎感染而请教医生,医生提供对应的建议。

3 下载 · 0 赞获取 →
多语种语音识别数据
语音识别多语种
多语种语音识别数据

由波形文件和 TSV 文件(line_index.tsv)组成。文件行_index.tsv 包含匿名的 FileID 和文件中的音频转录

5 下载 · 0 赞获取 →
TEDx Spanish Corpus
语音识别西班牙语
TEDx Spanish Corpus

这是一个性别不平衡的西班牙语语料库,期限为 24 小时。

0 下载 · 0 赞获取 →
ParlamentParla
Speech Recognition
ParlamentParla

语料库分为 90 小时清洁和 230 小时的其他质量段加泰罗尼亚自治政府文化部支持编写这一语料库。

0 下载 · 0 赞获取 →
Pansori-TEDxKR
Speech Recognition
Pansori-TEDxKR

是一种韩语语音识别 (ASR) 语种,由 2010 年至 2014 年在韩国举行的韩语 TEDx 会谈产生。

0 下载 · 0 赞获取 →
African Accented French
Speech Recognition
African Accented French

此语料库包含大约 22 小时的非洲口音法语的语音录音。为所有录音提供成绩单。

0 下载 · 0 赞获取 →
Tunisian_MSA
语音识别声学模型
Tunisian_MSA

突尼斯语-MSA语种有11.2小时的演讲时间。

0 下载 · 0 赞获取 →
Heroico
语音识别声学模型
Heroico

Heroico 语料库 (LDC2006S37) 最初是为了训练西班牙语学习应用中的发音建模声学模型而收集的。

0 下载 · 0 赞获取 →