语音之家
首页声浪活动AI科普学堂SOTA分享热聘会员服务
登录 注册

声浪

写文章
Xiaomi MiMo-V2.5 系列大模型开启公测
语音小管家语音小管家
转载6 months ago
Xiaomi MiMo-V2.5 系列大模型开启公测

以下文章来源于Xiaomi MiMo 今天凌晨,Xiaomi MiMo-V2.5 系列模型正式开启公测。 Xiaomi MiMo-V2.5 系列包含 MiMo-V2.5、V2.5-Pro 、V2.5-TTS Series 、V2.5-ASR…

开源模型
20 0 0
语音/音频处理学术速递[4.23]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.23]

语音识别语音合成
16 0 0
阿里正式开源Qwen3.6-27B,本地模型跑出 GPT-4 水准!
语音小管家语音小管家
转载6 months ago
阿里正式开源Qwen3.6-27B,本地模型跑出 GPT-4 水准!

昨晚,千问3.6系列最新模型Qwen3.6-27B正式开源! 该模型在核心编程能力评测中,以270亿的总参数量,性能媲美千亿参数级别模型。在SWE-bench、Terminal-Bench 2.0、SkillsBench、QwenWebBe…

开源模型
22 0 0
告别“只测反应不测智商”!清华&港中文联合发布 MTR-DuplexBench:全双工语音大模型的多轮对话“照妖镜”!
语音小管家语音小管家
原创6 months ago
告别“只测反应不测智商”!清华&港中文联合发布 MTR-DuplexBench:全双工语音大模型的多轮对话“照妖镜”!

文章链接:https://arxiv.org/pdf/2511.10262 仓库链接:https://github.com/ZhangHe0918/MTR-DuplexBench 数据集链接:https://huggingface.co/d…

语音大模型
32 0 0
基于命名实体知识与注意力聚合的鲁棒局部音频深度伪造检测
语音小管家语音小管家
转载6 months ago
基于命名实体知识与注意力聚合的鲁棒局部音频深度伪造检测

本次分享内容为内蒙古大学23 级硕士研究生 鲜鹄鸿、内蒙古大学刘瑞教授与美国约翰霍普金斯大学 Berrak Sisman、香港中文大学(深圳)/河套学院 李海洲教授合作发表于 APSIPA ASC 2025 的工作《NE-PADD: Lev…

音频伪造检测
22 0 0
语音/音频处理学术速递[4.22]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.22]

语音合成语音识别
19 0 0
Qwen3.5-Omni 技术报告:10 小时音频 + 400 秒视频通吃,ARIA 流式语音秒级响应
语音小管家语音小管家
转载6 months ago
Qwen3.5-Omni 技术报告:10 小时音频 + 400 秒视频通吃,ARIA 流式语音秒级响应

论文标题: Qwen3.5-Omni Technical Report 论文链接: https://arxiv.org/abs/2604.15804v1 代码链接: https://modelscope.cn/studios/Qwen/Qw…

开源模型
38 0 0
IEEE-TASLP 基于双路检索深度差异建模的音频深度伪造检测
语音小管家语音小管家
转载6 months ago
IEEE-TASLP 基于双路检索深度差异建模的音频深度伪造检测

本次分享由内蒙古大学24级博士生张锦华、内蒙古大学刘瑞教授与香港中文大学(深圳)/ 深圳河套学院 李海洲教授合作发表在IEEE Transactions on Audio, Speech and Language Processing 20…

音频伪造检测
18 0 0
语音/音频处理学术速递[4.21]
每日语音速递每日语音速递
原创6 months ago
语音/音频处理学术速递[4.21]

语音合成语音识别
17 0 0
通义发布语音识别大模型Fun-ASR1.5,懂方言,通诗词,精通30国语言
语音小管家语音小管家
转载6 months ago
通义发布语音识别大模型Fun-ASR1.5,懂方言,通诗词,精通30国语言

通义实验室正式推出 Fun-ASR1.5, 实现了「方言工业级可用」的语音识别大模型 。 它基于统一的大模型架构,单模型即可无缝覆盖30种语言、汉语七大方言体系及20+地方口音,古诗词吟诵也能精准转写。测试显示,典型方言场景字错误率(CER…

语音识别
38 0 0
‹1…3132333435…479›

热门主题

1资讯
2SpeechIO
3WeNet
4Kaldi
5AudioCC
6算法
7开源
8数据
9学术
10内推招聘

热文排行

1英伟达CPU问世:ARM架构,对比x86实现十倍性能提升2微软拟斥资 160 亿美元收购全球最大语音识别公司 Nuance3ImageNet验证集6%的标签都是错的,MIT:十大常用数据集没那么靠谱4WeNet更新:支持 CTC alignment52021全国声学大会语言声学分论坛报告—第三代语音识别技术初探6TIOBE 场景测试:经济 金融 货币7语音信号处理论文优选:Handling Background Noise in Neural Speech Generation8详解 WebRTC 高音质低延时的背后 — AGC(自动增益控制)9TIOBE 场景测试:汽车之家 汽车评测10推出 Lyra:用于语音压缩的新型极低比特率编解码器

活跃用户榜

语音小管家
语音小管家
已发表 3000 篇
每日语音速递
每日语音速递
已发表 991 篇
西工大音频语音与语言处理研究组
西工大音频语音与语言处理研究组
已发表 106 篇
SpeechIO
SpeechIO
已发表 82 篇
低调奋进
低调奋进
已发表 57 篇
机器之心
机器之心
已发表 45 篇
新智元
新智元
已发表 39 篇
阿里语音AI
阿里语音AI
已发表 33 篇
新一代Kaldi
新一代Kaldi
已发表 31 篇
THUHCSI人机语音交互实验室
THUHCSI人机语音交互实验室
已发表 29 篇

语音之家 SpeechHome

汇聚产学研各界开发者,覆盖语音识别、音频合成、声纹识别、视听多模态、物理 AI、具身听觉、人机交互等方向。

友情链接

中国计算机学会中国人工智能产业发展联盟中国人工智能学会魔搭社区希尔贝壳开源中国思否稀土掘金RTE开发者社区CSDNAI光影社 WeNetopenslrMongoDB中文社区

资源

声浪 活动 AI科普 分享 热聘 会员服务

关于

服务条款 隐私协议 合作伙伴

© 2026 语音之家 SpeechHome.com|京ICP备17027745号-4|京公网安备11010802032971号