声浪
美东时间2025年10月24日,东南大学外国语学院博士生导师陈彧教授和博士生王一诺、及加拿大维多利亚大学语言学系Sonya Bird教授题为Mandarin Tone Production in Prelingually Deaf Adul…
来源丨RTE开发者社区、首席智能官 由 Oculus 联合创始人创立的 AI 公司「Sesame」宣布完成由红杉资本 (Sequoia Capital) 和 Spark 共同领投的 2.5 亿美元 B 轮融资。 该公司正致力于构建一个极具表…
10月18日下午,NCMMSC-CNVSRC 2025 学术研讨会在江苏镇江召开的第二十届全国人机语音通讯学术会议(NCMMSC 2025)上举行。会上公布了本次视觉语音识别竞赛 CNVSRC 2025 的最终结果,并举行了颁奖仪式。 本次…
UniFlow-Audio: Unified Flow Matching for Audio Generation from Omni-Modalities 作者:徐薛楠¹,梅嘉豪²⁵,郑子豪¹²,陶也¹²,谢泽宇³,张耀匀²,刘濠赫⁴,吴…
无论是中文的粤语、闽南话、吴语,还是欧洲的荷兰比尔茨语方言、法国奥克语,亦或是非洲和南美的地方语言,方言都承载着独特的音系与文化记忆,是人类语言多样性的重要组成部分。然而,许多方言正在快速消失,语音技术如果不能覆盖这些语言,势必加剧数字鸿沟…
2025年10月20日下午,由深圳市科学技术协会指导,深圳市人工智能学会主办,深圳市人工智能学会机器人智能系统专业委员会和语音之家联合承办,深圳市华睿欣能投资控股集团有限公司支持的“机器听觉技术沙龙”在南山区智慧广场D栋二楼咖啡厅圆满举办。…
大家好,欢迎来到「AudioCC交我学」专栏! 作为学术研究者与实践者的连接点,我们致力于打造一个专注于语音技术的学术交流平台——「AudioCC交我学」专栏。在这里,我们将以简洁、专业的视角,解读听觉认知与计算声学领域的前沿论文,分享技术…
