显卡也能实时语音克隆!MOSS-TTS-Nano:0.1B 参数,支持流式和多语言
来源丨RTE开发者社区 近日,MOSI.AI 和 OpenMOSS 团队 开源了MOSS-TTS-Nano,一个0.1B参数 的多语言微型语音生成模型,直接把“实时语音克隆”门槛打到了地板价。 MOSS-TTS-Nano 专注于 TTS 部…
25 0 0
来源丨RTE开发者社区 近日,MOSI.AI 和 OpenMOSS 团队 开源了MOSS-TTS-Nano,一个0.1B参数 的多语言微型语音生成模型,直接把“实时语音克隆”门槛打到了地板价。 MOSS-TTS-Nano 专注于 TTS 部…
论文链接: https://arxiv.org/pdf/2508.06098v2 代码链接: https://github.com/xiquan-li/MeanAudio 发表会议: ACL 2026 近年来,文本转音频生成(TTA)技术取…
来源丨新智元、AI小展厅 面壁智能2B小模型VoxCPM 2惊艳开源,一众外国网友疯狂了!30种语言与9大方言它是信手拈来,复刻的贺炜激昂解说与徐志胜脱口秀,相似度简直直击灵魂。这哪是工具,分明是降维打击的生产力核武器! VoxCPM 2,…
来源丨paperWeekly 近日,南京大学与腾讯音乐发布开源语音大模型 VITA-Qinyu ,这是业内首款兼具自然对话、高表现力角色扮演与歌唱能力的 开源端到端语音语言模型 (SLM)。目前 VITA-QinYu 的训练代码与模型权重全…