ChinaVoices Challenge 中文多方言语音识别挑战赛结果正式揭晓
从赛事启动、数据发布,到公开评测、隐藏评测与系统复核,ChinaVoices Challenge 2026 中文多方言语音识别挑战赛现已圆满完成各项赛程。经过组委会对参赛结果、系统材料与合规情况的综合核验,赛事最终结果于近日正式发布! 本届…
33 0 0
从赛事启动、数据发布,到公开评测、隐藏评测与系统复核,ChinaVoices Challenge 2026 中文多方言语音识别挑战赛现已圆满完成各项赛程。经过组委会对参赛结果、系统材料与合规情况的综合核验,赛事最终结果于近日正式发布! 本届…
以下文章来源:努力犯错玩AI 近日,独立开发者 Owen Song 发布了 Inflect v2。这是一个极致轻量的英文语音合成模型。Micro 版只有 9.36M 参数,FP32 权重只有 37.5MB。Nano 版更是只有 3.97M…
良好的音频生成范式大概的确需要 latent。待压缩的音频无论取 patch 还是 STFT,从无到有的新 dim,本质上都承担着时域压缩的功能;但音频在不同时间尺度下有无法归纳的 semantic 周期,在频域做 polar 或原始 co…
近日,IIP-HCI实验室关于全类型音频深度伪造检测的最新研究成果被多媒体领域顶级国际会议 ACM MM 2026 接收。会议全称为 ACM International Conference on Multimedia,自1993年创办以来…
来源丨阿里语音AI 近年来,单通道语音分离技术犹如一场精彩的接力赛,从 Conv-TasNet 的精巧卷积,DPRNN 的深度循环,到 SepFormer 和 MossFormer 的 Transformer 革命,再到 TF-GridNe…
来源丨新智元 刚刚,Anthropic和OpenAI同时放出了语音模式大升级! Claude这边,从只能跑Haiku升级到Opus 4.8和Sonnet 5全系列,不仅能在对话里调Gmail、日历、Slack,还扩增到11种语言,但没有中文…