活动与赛事

ICASSP 2022 is pioneering a new event, the SPS Entrepreneurship Forum. The aim of this 1-day event is to promote entrepreneurship amongst the signal processing community, by sharing entrepreneurship journeys, discussing challenges and opportunities in translating signal processing research into commercial applications, providing a forum for pitching, and ultimately to train a new generation of signal processing entrepreneurs.

为了进一步促进国内人工听觉技术的发展,特别是跨学科、跨行业的合作交流,拟于2022年4月15日至17日在南京举办“2022 年人工听觉技术跨界研讨会”。

2022年1月12日,由国家工业信息安全发展研究中心为指导,中国语音产业联盟、国家语音及图像识别产品质量检验检测中心主办,声纹圈、语音之家承办的中国语音产业联盟•2022年系列线上活动——语音鉴伪主题沙龙成功举办,直播间吸引了850多人观看。

2021年12月4日,由中国计算机学会语音对话与听觉专委会、中国科学技术大学语音及语言信息处理国家工程实验室、中国科学技术大学电子工程与信息科学系主办的“语音合成专题学术论坛”在线上成功举办。论坛由中国科学技术大学凌震华教授主持,中国计算机学会语音对话与听觉专委会副主任、上海交通大学俞凯教授做活动致辞。论坛邀请了新加坡国立大学电气与计算机工程学院刘瑞博士、科大讯飞AI研究院语音合成方向研发主管胡亚军博士、微软亚洲研究院主管研究员谭旭博士、日本NII研究所王鑫博士做了分享报告,活动期间在线观众超过270人。

让计算机能听、能看、能说、能感觉,是未来人机交互的发展方向,其中语音已成为未来最被看好的人机交互方式,语音比其他的交互方式有更多的优势。

本次报告特邀西工大谢磊教授结合西工大音频语音与语言处理研究组的近期研究结果与大家交流分享~

2021年12月18日,首届东南亚非通用语种智能处理技术与应用研讨会在广西民族大学成功举办。

由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组 、字节跳动科技有限公司-智能创作语音团队、语音之家、北京希尔贝壳科技有限公司共同主办的【语音之家】AI产业沙龙-语音&音乐技术在字节跳动平台的应用,将于2021年12月23日12:00-14:00通过语音之家微信视频号直播。

Odyssey 2022(focus on VPR): The Speaker and Language Recognition Workshop will be hosted by Tsinghua Universty in Beijing, China for the first time, during June 28 - July 01, 2022.

作为清华大学深圳国际研究生院20周年院庆系列学术活动之一,中国计算机学会(CCF)语音对话与听觉专委会2021年学术年会12月17日在清华大学深圳国际研究生院召开,并通过语音之家微信视频号进行线上直播。

The ICASSP 2022 Acoustic Echo Cancellation Challenge is intended to stimulate research in the area of acoustic echo cancellation (AEC), which is an important part of speech enhancement and still a top issue in audio communication and conferencing systems. This is the third AEC challenge and it is enhanced by including mobile scenarios, adding speech recognition rate in the challenge goal metrics, and making the default sample rate 48 kHz. In this challenge, we open-source two large datasets to train AEC models under both single talk and double talk scenarios. These datasets consist of recordings from more than 7,500 real audio devices and human speakers in real environments, as well as a synthetic dataset. We also open source an online subjective test framework and provide an online objective metric service for researchers to quickly test their results. The winners of this challenge are selected based on the average Mean Opinion Score achieved across all different single talk and double talk scenarios, and the speech recognition rate.

中国语音产业联盟(Speech Industry Alliance of China,简称“SIAC”)是在工业和信息化部指导下,由中国境内从事语音技术和产品研究、开发、应用、服务及相关业务的企业、科研院所和服务机构自愿组成的全国性非盈利社会组织,以“平等自愿、优势互补、资源共享、合作共赢”为原则,积极推动语音产业链上、下游企业资源整合,加强产、学、研合作,构建健康产业生态体系,推进我国语音产业快速、健康发展。 近期,中国语音产业联盟将举办多场高质量沙龙,包括语音唤醒、语音合成、语音识别等专题讲座。2021年12月7日,将举办字幕语音识别ASR专题沙龙,届时由北京快手科技有限公司语音实验室首席架构师、语音算法质效负责人马永飞分享自动字幕识别效果优化实践与探索;由中国科学院声学研究所、中科院语言声学与内容理解重点实验室研究员、博士生导师赵庆卫分享智能语音技术近期进展及应用;由它思科技研究部负责人、清华大学天津电子信息研究院智能语音研究所副所长刘岩分享数据高效端到端语音识别技术实践及展望。

3D audio is gaining increasing interest in the machine learning community in recent years. The range of applications is incredibly wide, extending from virtual and real conferencing to autonomous driving, surveillance and many more. In these contexts, a fundamental procedure is to properly identify the nature of events present in a soundscape, their spatial position and eventually remove unwanted noises that can interfere with the useful signal. To this end, L3DAS22 Challenge presents two tasks: 3D Speech Enhancement and 3D Sound Event Localization and Detection, both relying on first-order Ambisonics recordings in reverberant office environments.

智能语音技术在网易的应用方式丰富多样,借助多场景下的海量数据,衍生出众多技术驱动的应用场景,从内容安全保障,到内容质量挖掘,让用户在内容海洋中尽情遨游。网易易盾团队通过语音关键词识别和语义理解,助力平台更快、更好、更低成本地筛选出违规内容。另一方面,网易云音乐团队对音乐进行理解、处理与生产,落地于音乐内容特质分析,音乐消费感知与创作门槛降低等方向,为用户提供多方位AI能力。

SH-CST 2021丨SpeechHome 语音技术研讨会

WOT全球技术创新大会2022

2018年Kaldi第三届技术交流会在北京成功举办!

2019年第四届Kaldi线下交流会

ICASSP 2022 Grand Challenge--首届语音深度合成鉴别挑战赛(ADD 2022)正式开启!

活动预告|语音合成专题学术论坛

近日,ICASSP 2022 多通道多方会议转录挑战(M2MeT)完成了测试集评测及结果公布。本次挑战由阿里巴巴达摩院语音实验室和希尔贝壳联合举办,多位国际知名行业专家包括达摩院语音实验室负责人鄢志杰、研究员马斌,希尔贝壳CEO卜辉,希尔贝壳基金会谢磊教授,美国俄亥俄州立大学汪德亮教授,丹麦奥尔堡大学谭政华教授,上海交通大学钱彦旻教授,新加坡A*STAR资讯通信研究院高级科学家Kong Aik Lee等参与大会组织和评审。

