陌陌科技,中国领先的社交网络和移动互联网公司,成立于2011年。最初以陌陌聊天应用闻名,用户可以通过地理位置找到附近的人并进行即时通讯。随着发展,陌陌逐渐扩展了其业务,包括直播、短视频和社交电商等。

陌陌的核心业务围绕社交互动,提供丰富的用户体验,通过各种社交功能吸引了大量年轻用户。近年来,公司还积极进行多元化发展,探索出海社交的潜力。团队亮点:有海量的语音数据支撑预训练模型的研发,计算资源充足;团队有较高的技术追求,优秀实习生有转正机会。

招聘岗位

Omni语音对话大模型算法研发工程师/实习生

工作职责:

1. 参与Omni语音对话大模型的预训练工作,包括模型架构设计、数据清洗、分布式训练及性能优化;

2. 探索文本-语音联合建模技术,优化端到端语音生成质量与延迟

3. 跟踪大模型与语音技术前沿进展(如LLM微调、RLHF、跨模态对齐等)。

任职条件:
• 熟悉Transformer、RNN等神经网络架构,有大模型的预训练或者SFT经验,掌握Deepspeed、Megatron等框架;
• 计算机相关专业硕士,有语音合成(如fishspeech、Index-tts、cosyvoice)或大语言模型(如GPT、LLaMA)研发经验,了解预训练流程;
• 熟悉Mini-Omni、Freeze-Omini、Minmo、Qwen-Omini等开源语音模型技术栈,具备数据处理、模型训练到部署的全流程经验。
• 团队协作意识强,对AI语音交互领域有热情。

大模型语音合成算法工程师/实习生

工作职责:

1. 主导大模型驱动的下一代语音合成技术研发,探索Prompt-TTS、对话语音合成等前沿方向,构建拟人化语音合成的技术壁垒;
2. 突破语音表现力瓶颈,重点优化副语言生成(如呼吸声、笑声)、情感韵律控制,实现接近真人对话的合成效果;
3. 研发基于LLM的TTS架构(如语音克隆、零样本自适应合成),提升自然度与实时性。

任职资格:

• 计算机/人工智能相关硕士学历,2年以上语音合成或大模型研发经验;
• 熟悉Transformer、RNN等神经网络架构,有大模型的预训练或者SFT经验,掌握Deepspeed、Megatron等框架;
• 掌握主流语音合成技术(如fishspeech、Index-tts、cosyvoice)、具备数据处理到模型部署的全流程经验;
• 对AI语音生成技术有强烈热情,具备良好的团队协作和跨领域沟通能力。
联系方式

邮箱主题:应聘岗位 + 姓名 + 语音之家推荐

邮箱:momo_speech_hire@126.com

地址:北京市朝阳区望京soho