作者NGK编辑部 本文将介绍如何基于新一代 Kaldi 框架快速搭建一个服务端的 ASR 系统,包括数据准备、模型训练测试、服务端部署运行。 更多内容建议参考: k2[1] icefall[2] lhotse[3] sherpa[4] 前言…
声浪
作者NGK编辑部 本文将介绍新一代 Kaldi 团队在 Conformer 上的改进工作。 更多内容建议参考: Reworked Conformer 模型代码[1] https://github.com/k2-fsa/icefall/blo…
01 标题:CTC Variations Through New WFST Topologies 链接:https://arxiv.org/pdf/2110.03098.pdf
作者:NGK编辑部 本文将介绍新一代 Kaldi 团队在 RNN-T 训练上近期所做的工作。其中内容已通过论文“Pruned RNN-T for fast, memory-efficient ASR training”投稿至 Intersp…
来源丨新一代Kaldi 早在2019年Daniel Povey就开始向外界透露他要开发Next-gen Kaldi,如今已经过去两年多了,那么Next-gen Kaldi 到底是什么呢?本文中小编试图通过这几年Daniel的对外演讲内容和日…
5月26日,数博会开幕式当天揭晓了“2022中国国际大数据产业博览会数博发布之领先科技成果”奖,“新一代Kaldi”项目,凭借全自研的创新成果和突出的社会价值,获得评委会一致认可,荣获“数博会领先科技成果奖·新技术”奖项!
9月13日(周一)陆主席主持COPU例会。本次会议主要议题是听取小米集团首席语音科学家Daniel Povey关于发布语音识别Kaldi新版的报告,并就Kaldi及其未来发展远景进行讨论。 参加会议的有:陆首群、刘澎、陈伟、梁志辉、宋可为、…
8月31日,Daniel Povey以小米集团首席语音科学家的身份,正式推出了新一代Kaldi。 作者 | 琰琰 来源丨AI科技评论 Daniel Povey是语音识别领域的执牛耳者,他主要开发和维护的开源工具Kaldi,是业界公认的语音识…
近年来,随着深度学习的快速发展,简单易用、性能稳定、开发高效的深度学习框架越来越被科研和工业界人员所需要。其中,TensorFlow和Pytorch则是目前深度学习的主流框架。在语音领域,基于C++开发的Kaldi工具因集成了语音相关的大量…
清华大学国家研究中心语音和语言技术团队撰写的《语音识别基本法》一书由电子工业出版社出版,张景中院士为该书做序。目前,该书已在京东、天猫等各大网站上架销售! 全书共256页,约30万字,共13章。本书结合当下使用广泛的Kaldi语音平台,对语…
