👋 各位语音技术爱好者们,大家好!

2026年过半,语音之家陪伴大家走过了一段充实的学习之旅。从线上公开课到论文解读,从技术沙龙到行业分享,我们一起探索了语音技术的方方面面。

为了方便大家回顾学习、查漏补缺,我们把这期间的所有活动资源做了一个超全汇总。建议收藏本文,随时翻看不迷路~


🎓 一、技术沙龙系列

行业实战经验分享,技术人面对面交流

序号

活动标题

01

StepAudio 2.5系列语音大模型思考和应用介绍

02

OSUM-Echat: 语音理解驱动的端到端共情口语对话生成模型

03

Step-Audio 2 技术分享交流会

04

低资源语言信息化和语言保护——以环南海濒危语言疍家话为例

05

探索Single-stage Auto-regressive Transformer框架下

06

OSUM:学术界有限资源推进开放语音理解大模型

👉快速通道

📄 二、论文解读系列

顶会论文逐篇精讲,紧跟学术前沿

序号

活动标题

01

ICASSP 2026 论文预讲会(共10期,33篇论文)

02

INTERSPEECH 2025 论文预讲会(共6期,22篇论文)

03

ICASSP 2025 论文预讲会(共14期,48篇论文)

04
INTERSPEECH 2026 论文预讲会(持续更新中...)

👉快速通道

🌐 三、公开课系列

语音技术前沿系统性探讨

序号

活动标题

01

第二届语音对话与听觉处理前沿进展研讨会

02

智能人机交互与语音技术前沿研讨会——CCF语音对话与听觉专委走进哈尔滨工程大学

03

大模型时代的语音处理研究研讨会——CCF语音对话与听觉专委走进香港中文大学(深圳)

👉快速通道

🌐 四、Xmart•学生论坛系列

由上海交通大学跨媒体语言智能实验室(SJTU X-LANCE lab)创办,中国计算机学会语音对话专委会主办,语音之家协办,为青年学生打造一个学术探讨,思维碰撞和多学科交叉融合的平台。

序号

活动标题

01

李凯:高效语音分离:架构、融合、因果性与数据

02

姜成翰:赋予口语语言模型思考能力

03

陈麒光:迈向推理时代:长思维链机理及应用

04

于文一:通用音频大模型:从通用感知到听说一体

05

姚继珣:歌曲生成与评估体系的探索研究

06

丁翰林:用于通用音频理解的可扩展方法

07

王远程:迈向自然且高效的语音合成

08

杨东超:面向多任务的音频基座模型:音频生成视角

09

周俊佐、任勇:语音的可溯源保护:音频水印研究

10

季圣鹏:端到端语音对话时代的机遇和挑战

11

袁锐斌:Scaling Foundation Models for Music

12

张绍磊:迈向实时跨语言沟通:实时语音模型的挑战、技术和未来

13

肖俊斌、李磊磊:面向第一视角的具身问答辅助技术:研究与展望&第一视角下的交通事故视频溯因理解

14

郭子睿:从检索增强生成到图增强生成:探索新一代智能问答系统

👉快速通道

📺 除了这里,还能在哪里看?

如果不方便通过本文链接跳转,你也可以通过以下方式找到我们的全部内容:

📱 关注本公众号,在菜单栏点击「工匠学堂」也能找到历史活动。

✨写在最后

感谢大家一路以来的支持与陪伴。语音之家会继续努力,为大家带来更多高质量的技术分享和学习资源。

如果这份汇总对你有帮助,欢迎点赞、在看、转发给身边同样在学习语音技术的朋友~