由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组 、北京希尔贝壳科技有限公司、语音之家(北京)科技有限公司、腾讯天籁实验室共同主办的【语音之家】AI技术沙龙——语音增强,将于2021年8月14号 9:30在线上直播…
声浪
语音识别一直是一个热门的研究领域,过去几十年,语音识别技术逐步发展,识别准确率逐步上升。人们开发了不少成功的语音识别、人机交互系统。然而,在实际应用场景变得复杂的时候,许多语音识别系统更像温室里的花朵,在现实世界中性能大打折扣。 在实验场景…
每个行业都有各自要解决的特定工程问题。工程师的日常工作就是不断解决问题,最关键的能力是解决工程问题的能力,直接的体现是设计方案的优劣和方案实施的效率。要理解工程师的能力包括什么,就是说要明确以下两个子问题: 1)工程师要解决的问题是什么?…
工作以来主要从事TTS工作,平时看些文章做些笔记。文章中难免存在错误的地方,还望大家海涵。如转载,请标明出处。平时搜集一些资料,方便查阅学习: TTS 论文列表:http://yqli.tech/page/tts_paper.html TT…
声明:平时看些文章做些笔记分享出来,文章中难免存在错误的地方,还望大家海涵。平时搜集一些资料,方便查阅学习:http://yqli.tech/page/speech.html。如转载,请标明出处。 Streaming End-to-End…
语音合成 (Text-to-speech, TTS) ,又称文语转换技术,是将文字转换为自然语音的一类技术,是服务于语音交互、信息播报、有声朗读等任务的核心技术。TTS是一个典型的序列到序列(Seq2Seq)任务。然而和机器翻译等NLP中的…
声明:语音合成论文优选系列主要分享论文,分享论文不做直接翻译,所写的内容主要对文章简略概括。如有转载,请标注来源。 AdaSpeech 3: Adaptive Text to Speech for Spontaneous Style 本文为…
Streaming End-to-End ASR based on Blockwise Non-Autoregressive Models 本文为Johns Hopkins University在2021.07.20更新的文章,主要使用bl…
ASLP嗑盐君 音频语音与语言处理研究组 2019-08-29近期,实验室孙思宁、郭鹏程同学的论文“Adversarial Regularization for Attention Based End-to-End Robust Speec…
