我的资源
共 246 个数据集
开源发布丨SMIIP-NV 语料库
语音合成
开源发布丨SMIIP-NV 语料库

SMIIP-NV 语料库是一个同时标注了情感与非言语声音的语音合成语料库,非言语声音涵盖了笑声、哭声以及咳嗽声。

0 下载 · 2 赞获取 →
开源发布丨Music-Eval 生成式音乐评分数据集
生成式音乐评分
开源发布丨Music-Eval 生成式音乐评分数据集

希尔贝壳联合南开大学正式开源首个“MusicEval 生成式音乐评分数据集”。该数据集整合了主流模型生成的音乐样本与专家专业评分,还配套了针对性的自动评估模型,为 TTM 评估提供了全新的解决方案。

0 下载 · 0 赞获取 →
AISHELL-5 全球首套智能驾舱中文语音交互数据集
AISHELL-5 全球首套智能驾舱中文语音交互数据集

AISHELL-5是首个开源的真实车载多通道、多说话人中文自动语音识别(ASR)高质量数据集。

0 下载 · 0 赞获取 →
超大杯 Emilia-Large
TTS
超大杯 Emilia-Large

超大杯 Emilia-Large 来了!200K+ 小时多语言语音数据集

0 下载 · 0 赞获取 →
PASCAL VOC
Object DetetctionSemantic Segmentation
PASCAL VOC

The PASCAL VOC (Visual Object Classes) dataset is a well-known object detection, segmentation, and classification dataset. It is designed to encourage research on a wide variety of object categories and is commonly used for benchmarking computer vision models. It is an essential dataset for researchers and developers working on object detection, segmentation, and classification tasks.

0 下载 · 0 赞获取 →
ImageNet
Object Detetction
ImageNet

an image database organized according to the WordNet hierarchy (currently only the nouns), in which each node of the hierarchy is depicted by hundreds and thousands of images.

0 下载 · 0 赞获取 →
OpenImages-v6
MultiLabel ClassificationObject Detetction
OpenImages-v6

The Open Images Dataset V4: Unified image classification, object detection, and visual relationship detection at scale

0 下载 · 0 赞获取 →
MS-COCO
Object segmentationRecognition in contextSuperpixel stuff segmentationObject segmentation
MS-COCO

a large-scale object detection, segmentation, and captioning dataset.

0 下载 · 0 赞获取 →
ASR-SECOMICSC
Speech Recognition
ASR-SECOMICSC

A CHINESE-ENGLISH CODE-MIXING CONVERSATIONAL SPEECH CORPUS

0 下载 · 0 赞获取 →
ASR-DEVCECOMICSC
Speech Recognition
ASR-DEVCECOMICSC

A DEV SET OF CHINESE-ENGLISH CODE-MIXING CONVERSATIONAL SPEECH CORPUS

0 下载 · 0 赞获取 →
超10万小时的语音生成数据集 Emilia 现已开放下载!
语音合成
超10万小时的语音生成数据集 Emilia 现已开放下载!

Amphion团队在 Hugging Face和OpenDataLab 平台上开源了 Emilia数据集。这一数据集是全球最大且最为多样的多语言语音数据集之一。

0 下载 · 0 赞获取 →
RealMAN
多通道麦克风语音噪声数据
RealMAN

希尔贝壳(AISHELL)与西湖大学音频信息与信号处理实验室(AUDIOLAB)联合开源了一个规模较大、实录、带标注的多通道麦克风语音与噪声数据集( RealMAN)。

0 下载 · 0 赞获取 →