1、负责面向应用场景的实时/非实时语音识别技术体系的研发和应用。
2、负责面向数字人的语音驱动表情动画的技术研发和应用。
3、负责跟进行业前沿技术发展趋势,跟踪国际前沿算法发展方向和相应技术。
1、硕士及以上学历优先,计算机、信号处理、数学、统计等专业优先。
2、熟悉语音识别核心算法如Zipformer、Transformer,LSTM、HMM,GMM,Viterbi等。
3、熟悉端点检测、声学模型、语言模型以及后处理等并具备较好的应用实践经验。
4、熟练掌握Kaldi,Wenet,RNNLM,TensorFlow、pytorch等一种及以上。
5、熟悉语音驱动视觉动画相关技术,有一定基础经验,了解视觉和数字人等基础知识。
6、较强的自学能力和独立思考能力,善于思考和表达自己的想法,同时又具备良好的团队合作精神。
7、在相关国际会议或主流期刊上发表论文者优先(ICASSP,Interspeech)。
1、负责语音合成文本前端、声学模型或声码器等技术研发和应用。
2、负责语音合成大模型如VALL-E以及语音口型表情等新技术的探索研发和应用。
3、负责持续跟进业界前沿算法发展方向,支持公司在核心技术上的影响力发展。
1、硕士及以上学历优先,计算机、信号处理、数学、统计等专业优先。
2、熟悉语音识别核心算法如Zipformer、Transformer,LSTM、HMM,GMM,Viterbi等。
3、熟悉端点检测、声学模型、语言模型以及后处理等并具备较好的应用实践经验。
1、计算机、信号、数学或统计学等相关专业方向的硕士及硕士以上。
2、熟悉常用语音合成的原理框架,如:HTS、FastSpeech、Tacotron、Vits、HifiGAN等。
3、熟练使用pytorch/tensorflow深度学习框架,具备Python/C/C++编程功底,应用经验丰富。
4、对Diffusion扩散模型、One-shot模型 VALLE、超自然语音生成有一定的理解或应用。
5、具备较强的自学能力和独立思考能力,善于思考和表达自己的想法,具备良好的团队合作精神。
6、在相关国际会议或主流期刊上发表论文者优先(ICASSP,Interspeech),有参加Blizzard竞赛经验者优先。
1、负责AI作词、AI作曲、AI编曲、AI歌声等AIGC算法的探索和研发。
2、负责音乐均衡器、混音、评分、MIR等算法的探索和研发。
3、负责跟进行业前沿技术发展趋势,支持公司在核心技术上的影响力发展。
1、计算机、音乐、信号、数学或统计学等相关专业方向的硕士及硕士以上。
2、具备较好的音乐乐理知识,热爱音乐,对AI音乐生成算法具有强烈兴趣。
3、熟练使用pytorch/tensorflow深度学习框架,有Python/C/C++编程功底,应用经验丰富。
4、熟悉ai音乐生成相关算法或工具如Transformer/Diffusion/VAE/Magenta/AIVA/Mubert等。
5、较强的自学能力和独立思考能力,善于思考和表达自己的想法,具备良好的团队合作精神。
6、在相关国际会议或主流期刊上发表论文或参与相关竞赛者优先(如ICASSP,Interspeech)。
邮箱主题:姓名 + 申请职位 + 语音之家推荐

