声浪
工程经验分享 Incremental FastPitch
分享 NVIDIA 基于 GPU 的 TTS 解决方案介绍。 1.基于 FastPitch+Hifi-GAN 的 Streaming TTS 效果优化 NVIDIA 在 TTS 领域也做了一些供大家参考的工作,例如提供了高效的流式 TTS…
69 0 0
NPU-ASLP实验室10篇论文被ICASSP2024录用
西工大音频语音与语言处理研究组(ASLP@NPU)在本届会议将携合作伙伴宣读论文10篇,涉及智能语音处理领域的众多研究方向,包括语音识别、语音合成与转换、语音增强等。论文的合作单位包括理想汽车、网易、喜马拉雅、字节跳动、马上金融、出门问问、…
107 0 0
Sensors|基于交互注意力音视频融合的人员验证
标题:Audio–Visual Fusion Based on Interactive Attention for Person Verification 作者:景雪斌,何亮,宋志达,王少磊 单位:新疆大学计算机科学与技术学院、清华大学电子…
50 0 0
NCMMSC 2023论文|基于概率稀疏自注意力的说话人自适应语音合成
标题:Explore Speaker Adaptation Text-to-Speech Method Based ProbSparse Self-attention 作者:冷媛媛,王宗挥,方志华,张云祥,何亮 单位:新疆大学计算机科学与技…
36 0 0
GPT-SoVits: 上线两天获得了1.4k star的开源声音克隆项目,1分钟语音训练TTS模型
近期,RVC变声器创始人 (GitHub昵称:RVC-Boss)开源了一款跨语言音色克隆项目 GPT-SoVITS。项目一上线就引来了互联网大佬和博主的好评推荐,不到两天时间就已经在GitHub上获得了1.4k Star量。 项目地址:ht…
101 0 0
