智谱AI致力于打造新一代认知智能大模型,专注于做大模型的中国创新。公司于2020年底研发GLM预训练架构,2021年训练完成百亿参数模型GLM-10B,同年利用MoE架构成功训练出收敛的万亿稀疏模型,2022年合作研发了中英双语千亿级超大规模预训练模型GLM-130B并开源。2023 年,智谱 AI 推出千亿基座对话模型ChatGLM并两次升级,开源版本的 ChatGLM-6B 让大模型开发者的本地微调和部署成为可能,在开源社区受到广泛欢迎。
音频生成算法工程师
从事音频生成算法研究、训练、应用,包括人声、音乐、音效等方面;
负责模型的多机多卡训练、高性能推理等;
负责将生成技术落地到业务,并进行持续优化。
硕士及以上学历,计算机、数学、通信等相关专业;
具备良好的学习能力、逻辑思维能力、沟通协作能力;
有三年及以上语音合成算法经验,或三篇及以上顶会论文(各类CCF-A会、ICASSP/INTERSPEECH等);
熟练使用Python和Pytorch/Tensorflow深度学习框架;
对以下至少一种熟悉并有相关经验: 大模型的框架&理论,包括但不限于Diffusion、Vall-E/SpearTTS/AudioLM、MusicLM;
各类声码器的原理&优化,包括但不限于Hifi-GAN,MelGAN,BigvGAN;
上一代语音合成模型,包括但不限于Tacotron、Fastspeech;
有业务落地工程经验优先。
邮箱主题:姓名 + 申请岗位 + 语音之家推荐
工作地点:北京

