招聘岗位

语音算法工程师

(校招&社招)

工作职责

1、负责语音合成、语音识别、数字人、音乐内容生成方向的算法研发、性能优化与落地实现。

2、负责虚拟人交互场景下的AIGC音频大模型、个性化实时情感对话语音合成、篇章语音合成、低资源音色克隆、变声、表情手势动作生成、舞蹈动作生成、多风格歌声合成、嘻哈合成、声伴分离、自动作曲、音乐高潮检测、实时大并发流式语音识别、说话人识别和分割、语种识别、声音事件检测、语音增强、关键词唤醒、3A音频算法、空间音频等技术研发。

3、负责语音算法相关的后台工程开发、云服务建设、性能优化。

4、跟进学术界、行业最新的研究趋势,产出新的科研成果,并落地于实际产品。

任职要求

1、硕士或博士(优秀本科生亦可),人工智能、语音、自然语言处理、机器学习、信号处理、计算机、电子信息、自动化等相关专业方向,基础扎实。

2、深刻理解TTS原理,熟悉TTS前端TN、G2P、韵律预测等,熟悉开源架构声学模型 Tacotron、FastSpeech、VITS和声码器WaveGlow、WaveRNN、HifiGAN等。

3、熟悉主流的语音识别模型算法,如RNN-T、conformer,熟悉kaldi/K2/wenet/espnet等工具。

4、熟练掌握机器学习算法,有较强的算法实现能力,熟练掌握 Python/C/C++/Java/Shell编程,熟悉Linux系统,至少熟练使用一种深度学习训练框架,如Tensorflow、Pytorch等。

5、熟悉高性能计算后台开发相关的异构并行、多线程、SIMD等技术,熟悉OpenMP、MKL、Eigen、protobuf、C++等工具。

6、在计算及科学相关会议或期刊(如IEEE TASLP、Speech Communication、NIPS、ICML、ICASSP、Interspeech、ASRU、ISCSLP等)发表过文章,或者参加过相关国际比赛者优先。

7、学习能力强,优秀的分析问题和解决问题的能力,对解决具有挑战性的问题充满激情。

简历投递

邮箱主题:姓名 + 申请岗位 + 语音之家推荐

邮箱:arvinxu@xverse.cn

地址:深圳南山区软件产业基地