多模态语音识别资深算法工程师——社招、应届或实习均可
职位描述

1、负责面向应用场景的实时/非实时语音识别技术体系的研发和应用。

2、负责面向数字人的语音驱动表情动画的技术研发和应用。

3、负责跟进行业前沿技术发展趋势,跟踪国际前沿算法发展方向和相应技术。

岗位要求

1、硕士及以上学历优先,计算机、信号处理、数学、统计等专业优先。

2、熟悉语音识别核心算法如Zipformer、Transformer,LSTM、HMM,GMM,Viterbi等。

3、熟悉端点检测、声学模型、语言模型以及后处理等并具备较好的应用实践经验。

4、熟练掌握Kaldi,Wenet,RNNLM,TensorFlow、pytorch等一种及以上。

5、熟悉语音驱动视觉动画相关技术,有一定基础经验,了解视觉和数字人等基础知识。

6、较强的自学能力和独立思考能力,善于思考和表达自己的想法,同时又具备良好的团队合作精神。

7、在相关国际会议或主流期刊上发表论文者优先(ICASSP,Interspeech)。

多模态语音合成资深算法工程师——社招
职位描述

1、负责语音合成文本前端、声学模型或声码器等技术研发和应用。

2、负责语音合成大模型如VALL-E以及语音口型表情等新技术的探索研发和应用。

3、负责持续跟进业界前沿算法发展方向,支持公司在核心技术上的影响力发展。

岗位要求

1、硕士及以上学历优先,计算机、信号处理、数学、统计等专业优先。

2、熟悉语音识别核心算法如Zipformer、Transformer,LSTM、HMM,GMM,Viterbi等。

3、熟悉端点检测、声学模型、语言模型以及后处理等并具备较好的应用实践经验。

1、计算机、信号、数学或统计学等相关专业方向的硕士及硕士以上。

2、熟悉常用语音合成的原理框架,如:HTS、FastSpeech、Tacotron、Vits、HifiGAN等。

3、熟练使用pytorch/tensorflow深度学习框架,具备Python/C/C++编程功底,应用经验丰富。

4、对Diffusion扩散模型、One-shot模型 VALLE、超自然语音生成有一定的理解或应用。

5、具备较强的自学能力和独立思考能力,善于思考和表达自己的想法,具备良好的团队合作精神。

6、在相关国际会议或主流期刊上发表论文者优先(ICASSP,Interspeech),有参加Blizzard竞赛经验者优先。

多模态音频音乐合成资深算法工程师——社招
职位描述

1、负责AI作词、AI作曲、AI编曲、AI歌声等AIGC算法的探索和研发。

2、负责音乐均衡器、混音、评分、MIR等算法的探索和研发。

3、负责跟进行业前沿技术发展趋势,支持公司在核心技术上的影响力发展。

岗位要求

1、计算机、音乐、信号、数学或统计学等相关专业方向的硕士及硕士以上。

2、具备较好的音乐乐理知识,热爱音乐,对AI音乐生成算法具有强烈兴趣。

3、熟练使用pytorch/tensorflow深度学习框架,有Python/C/C++编程功底,应用经验丰富。

4、熟悉ai音乐生成相关算法或工具如Transformer/Diffusion/VAE/Magenta/AIVA/Mubert等。

5、较强的自学能力和独立思考能力,善于思考和表达自己的想法,具备良好的团队合作精神。

6、在相关国际会议或主流期刊上发表论文或参与相关竞赛者优先(如ICASSP,Interspeech)。

简历投递

邮箱主题:姓名 + 申请职位 + 语音之家推荐

邮箱:liuzhongliang@soulapp.cn
地址:北京