语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
ICASSP 2026 | 南京大学音频声学实验室(NJU-AALab)10篇论文展示+2项赛事冠军
语音小管家语音小管家
转载3 months ago
ICASSP 2026 | 南京大学音频声学实验室(NJU-AALab)10篇论文展示+2项赛事冠军

以下文章来自:南京大学音频声学实验室(NJU-AALab) ICASSP(International Conference on Acoustics, Speech, and Signal Processing)是由IEEE信号处理学会主办…

语音合成语音识别
18 0 0
语音与音频学术速递[7.8]
每日语音速递每日语音速递
原创3 months ago
语音与音频学术速递[7.8]

语音合成语音识别
12 0 0
语音与音频学术速递[7.7]
每日语音速递每日语音速递
原创3 months ago
语音与音频学术速递[7.7]

语音合成语音识别
15 0 0
GLSC-SDR:联合学习全局-局部说话人分类以促进说话人日志与语音识别
语音小管家语音小管家
转载3 months ago
GLSC-SDR:联合学习全局-局部说话人分类以促进说话人日志与语音识别

当前,大音频语言模型(LALM)在端到端说话人日志与识别任务中展现出优异性能。但受大规模对话语料稀缺、缺少显式说话人表征优化机制限制,模型的说话人区分能力仍存在短板。现有提升大音频语言模型说话人精度的主流方法,无论是引入额外编码器、设计注册…

语音识别
17 0 0
阿里发布 Fun-ASR-Realtime 实时语音识别模型  ,支持16种方言和30种语言!
语音小管家语音小管家
转载3 months ago
阿里发布 Fun-ASR-Realtime 实时语音识别模型 ,支持16种方言和30种语言!

来源丨千问大模型 今天,阿里通义升级实时语音识别大模型Fun-ASR-Realtime——一款首字延迟控制在百毫秒级别、识别准确率接近离线模型的流式语音识别模型,支持16种方言和30种语言。 阿里云百炼: Fun-ASR-Realtime:…

语音识别
42 2 1
INTERSPEECH 2026|武汉大学电子信息学院智能音频与语音感知实验室13篇录用论文分享
语音小管家语音小管家
转载3 months ago
INTERSPEECH 2026|武汉大学电子信息学院智能音频与语音感知实验室13篇录用论文分享

分享武汉大学电子信息学院智能音频与语音感知实验室在Interspeech 2026中稿的13篇论文,论文涵盖语音增强、声源定位、声音事件检测、音频表征、音频大模型等多个研究方向。 ⏩一、多通道语音增强与鲁棒波束形成 Joint Learni…

语音合成语音识别
18 0 0
语音与音频学术速递[7.3]
每日语音速递每日语音速递
原创3 months ago
语音与音频学术速递[7.3]

语音合成语音识别
17 0 0
语音与音频学术速递[7.2]
每日语音速递每日语音速递
原创3 months ago
语音与音频学术速递[7.2]

语音合成语音识别
13 0 0
【收藏】2025-2026中旬语音之家活动资源全汇总,一键直达学习!
语音小管家语音小管家
原创3 months ago
【收藏】2025-2026中旬语音之家活动资源全汇总,一键直达学习!

👋 各位语音技术爱好者们,大家好! 2026年过半,语音之家陪伴大家走过了一段充实的学习之旅。从线上公开课到论文解读,从技术沙龙到行业分享,我们一起探索了语音技术的方方面面。 为了方便大家回顾学习、查漏补缺,我们把这期间的所有活动资源做了…

语音合成语音识别
12 0 0
语音与音频学术速递[7.1]
每日语音速递每日语音速递
原创3 months ago
语音与音频学术速递[7.1]

语音合成语音识别
9 0 0
‹1…45678…129›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:汽车之家 汽车评测7TIOBE 场景测试:经济 金融 货币8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9语音信号处理论文优选:Handling Background Noise in Neural Speech Generation10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号