0、摘要 本文总结了使用大型自动语言识别(ASR)模型进行的大量工作的结果,这些模型使用了包含大约一百万小时音频的无标签数据集进行预训练。作者发现,预训练、自监督训练和增大模型大小这三种方法的结合可以极大地提高数据有效利用率,即使对具有数万…
声浪
百万小时无监督数据上训练80亿参数模型,多项语音任务上SoTA,语音的ImageNet时刻?(一)
762 1 0
语音识别(ASR)论文优选:Adapting GPT, GPT-2 and BERT Language Models for Speech Recognition
1、研究背景 预训练模型的Bert, GPT,GPT2为下游诸多nlp任务提供很好的帮助,但其在ASR中应用却很少研究,因此本文主要研究这些预训练模型Bert, GPT,GPT2在ASR中的应用。 2、详细设计 本文主要回顾一下Transf…
423 0 0
语音识别(ASR)论文优选:Tied & Reduced RNN-T Decoder
声明:平时看些文章做些笔记分享出来,文章中难免存在错误的地方,还望大家海涵。平时搜集一些资料,方便查阅学习:http://yqli.tech/page/speech.html。 如转载,请标明出处。欢迎关注微信公众号:低调奋进 Tied &…
220 1 0
动态 Chunk Conformer 在线+离线混合 ASR 模型
这次要分享的是出门问问最近分享的一篇 Paper Unified Streaming and Non-streaming Two-pass End-to-end Model for Speech Recognition,他们团队还并奉上了训…
336 1 0
今年的 COSCon 中国开源年会,让我们聊点不一样的
人们常常说,在熬过了数十年寒冬,2020 -2021 我们终于迎来了本土开源的拐点,国家政策的引导、基础软件的崛起、开放协作精神的觉醒……各种各样的数据报告也无一不支撑着这一观点。 GitHub 2015 - 2020 年事件日志量、活跃仓…
179 0 0
语音识别-贵州话-short8转写
语音识别的研究工作对于信息化社会的发展,人们生活水平的提高等方面有着深远的意义。随着计算机信息技术的不断发展,语音识别技术将取得更多重大突破,语音识别系统的研究将会更加深入,有着更加广阔的发展空间。语音识别是解决机器“听懂”人类语言的一项技…
226 0 0
2021“天马杯”全球高校科技创新大赛-语音赛道正式启动!
由马上消费人工智能研究院&马科大研究院主办的科技主题杯赛“天马杯全球高校科技创新大赛”已正式启动,其中语音赛道由西北工业大学、北京希尔贝壳科技有限公司联办。
30 0 0
