OpenSpeaker:从零实现一套声纹识别系统
转载5 years ago
OpenSpeaker:从零实现一套声纹识别系统

前言:有感于早些年前学习语音时,在Kaldi庞大的框架和脚本里挣扎了很久,而且对于深度学习模型训练、推理、部署、优化等也困惑了很久,现如今有时间,就想实现一套最简单的自包含方案,系统的说明一套语音服务从训练到部署的全套流程,方便新人学习,也…

455 1 0
调研报告|在线语音识别改进之 RNN-T 训练
转载5 years ago
调研报告|在线语音识别改进之 RNN-T 训练

这篇文章主要调研的是另外一种改进在线语音识别的方法:基于 RNN Transducer 方法。这篇文章可能文字讲解的地方会比较少,因为图片的内容信息量已经很大了,同时论文的出处我会一并放出,有兴趣的朋友可以阅读下原文。因为我本人是基于 Te…

678 1 0
基于深度学习的声纹识别概述(二)
转载5 years ago
基于深度学习的声纹识别概述(二)

前言:做技术不能只见树木,不见森林,读综述类的论文,能很好的帮我们把握业界的前进方向。本文是由西工大张晓雷教授所作,于2021年4月4日更新,全面的分析了说话人识别方向的几个关注点,本文及接下来的几篇文章会详细的分析这篇论文。 本系列第一部…

290 1 0
ASR Conformer模型论文及代码分析
转载5 years ago
ASR Conformer模型论文及代码分析

0. 前言 Conformer是Google在2020年提出的语音识别模型,基于Transformer改进而来,主要的改进点在于Transformer在提取长序列依赖的时候更有效,而卷积则擅长提取局部特征,因此将卷积应用于Transform…

587 2 0