原论文是google在今年二月份更新的,主要研究在语音编码器如何处理背景噪声,使声码器合成的语音质量更高。 研究背景 低码率的语音编码器(语音编码器可参考http://www.ece.ubc.ca/~brucew/ebook/VOIP/00…
声浪
日前,希尔贝壳和出门问问合作,在 WeNet 中更新了对 AISHELL-2 数据集的支持,开放数据准备、训练和解码测试和部署等流程,并开放基于 AISHELL-2 的预训练模型。其中,AISHELL-2 数据由希尔贝壳提供。希尔贝壳开源数…
这个讲座及演示是基于侯晨钟为今年的CGDC技术专场制作的技术展示项目。尽管这个项目的规模很小,但侯晨钟在其中对市场上既有的及没有的游戏音频/音乐设计技术进行了实践与探索。 整个项目中基本的声音行为、互动音乐系统、及空间音频均使用了Audio…
通过语音和视频通话与他人在线联系逐渐成为日常生活的一部分,这得益于 WebRTC 等实时通信框架,而后者依靠高效的压缩技术和编解码器,解码或编码传输和存储的信号。数十年来,编解码器一直是媒体应用的重要组成部分,可使需要占用大量带宽的应用高效…
为加强对具有舆论属性或社会动员能力的互联网信息服务和相关新技术新应用的安全管理,规范互联网信息服务活动,切实维护国家安全、社会秩序和公共利益,近日,国家互联网信息办公室、公安部指导各地网信部门、公安机关加强对语音社交软件和涉“深度伪造”技术…
人工智能作为新一轮产业变革的核心驱动力,正在释放历次科技革命和产业变革的巨大能量。持续探索新一代人工智能应用场景,将重构生产、分配、交换、消费等经济活动各环节,催生新技术、新产品、新产业。作为数字经济转型升级的推动力和新一轮科技竞赛的制高点…
AI独角兽泡沫破裂:高管离职、裁员、数据打架、上市中止、营收崩溃。“早预料到今天的情况,所以也没有太意外。” 依图科技研发人员高强告诉Tech星球,3月12日听到自家公司中止科创板上市的消息时,情绪并没有太震动。在近期云知声、京东数科、禾赛…
2020年,爱奇艺联合北京希尔贝壳科技有限公司、西北工业大学音频语音与语言处理研究组、清华大学深圳国际研究生院、新加坡国立大学、起源智能在ICASSP2021举办多说话人多风格音色克隆大赛——M2VoC,旨在提供一个通用的数据集以及一个公平…
Yoshua Bengio团队推出开源语音处理工具包 ——SpeechBrain。 地址: GitHub:https://github.com/speechbrain/speechbrain 官网:https://speechbrain.g…
打造实时对话式AI服务,NVIDIA发布Jarvis 1.0公测版。 据智东西报道,凭借听、读、译三大功能,对话式人工智能(AI)正逐渐深入人们的生活,成为解放双手和提高生产力的关键工具。 当你说话时,对话式AI能实时将你说的话记录成文字,…
