近日,在全球音频技术顶尖会议ICASSP 2022举办的AEC Challenge(Acoustic Echo Cancellation Challenge)回声消除比赛中,快手音视频技术团队在近端单讲音质、远端单讲回声消除、双讲音质和回声…
声浪
在深度学习、大数据和大算力的推动下,以语音增强、识别和合成为代表的智能语音技术已经在众多应用中落地。特为大家整理了一些比较前沿的报告,文末可免费获取。 No.1
国音智能 国音智能(SpeakIn)创立于2015年,作为城市数字化基础设施供应商和AIOT智能化方案供应商,秉持“帮助城市设施与机器更好地服务于人”为使命,以先进的人工智能技术和传感技术为驱动,加速城市数字场景的智能化进程。 国音智能云集…
近期,来自北京大学和腾讯AI LAB, ASR oteam的研究人员在主流端到端语音识别系统上进行了两点改进:(1)将LF-MMI准则用于端到端语音识别系统的训练和解码中;(2)使用词级别N-gram模型进行在线解码。集成上述两点的端到端模…
人们通过聆听和观察说话者的嘴唇动作来感知言语。那么,AI 也可以吗? 事实上,研究表明视觉线索在语言学习中起着关键的作用。相比之下,人工智能语言识别系统主要是建立在音频上。而且需要大量数据来训练,通常需要数万小时的记录。 为了研究视觉效果,…
借助读唇语,人类能够更容易听懂他人的讲话内容,那么AI也能如此吗? 最近,Meta提出了一种视听版BERT,不仅能读唇语,还能将识别错误率降低75%。效果大概就像如下这样,给一段视频,该模型就能根据人物的口型及语音输出他所说的内容。 而且与…
这是neurips 2021的为数不多的,oral的,而且多少我能看懂一点点的一篇爽文。来自facebook AI和google AI. (这两个team在一起搞事情---有趣;看了脚注之后,知道,第三作者是在facebook AI期间参与…
本文将为大家介绍「如何使用Adapter(适配器)结构、基于元学习和迁移学习思想对预训练语音识别(ASR)模型进行跨语言的迁移」。在这项工作中,我们主要研究了如何利用Adapter进行高参数效率(parameter-efficient)的预…
12月18日,在中国智能语音产业发展高峰论坛暨中国语音产业联盟2021年会现场,中国语音产业联盟发布《2020~2021中国语音产业发展白皮书》(以下简称「《白皮书》」),总结这一年来智能语音行业的发展态势,把脉语音产业、指引未来走向。 智…
