1、负责多模态大模型的研发和应用,研究相关技术在豆包、智能助手、智能硬件等领域的全新应用和解决方案,包括而不限于多模态音视频理解生成,视觉Agent等能力,研发以人工智能技术为核心的新技术、新产品;
2、探索超大规模模型,进行极致系统优化;
3、数据建设、指令微调、偏好对齐、模型优化;
4、相关应用落地,包括看图对话、问答、搜索、生成创作、逻辑推理、代码生成等; 5、在未来生活中的更多使用场景的深入研究和探索,满足用户不断增长的智能交互需求,全面提升用户在未来世界的生活和交流方式
6、 有语音识别、语音合成相关经验优先
1、优秀的代码能力、数据结构和基础算法功底,熟练C/C++或Python,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
2、具有优秀的基础算法、扎实的机器学习基础,熟悉CV、AIGC、NLP、RL、ML等领域的技术,在CVPR、ECCV、ICCV、NeurIPS、ICLR、SIGGRAPH或SIGGRAPH Asia等顶级会议/期刊上发表论文者优先;
3、熟悉NLP、CV相关的算法和技术,熟悉大模型训练、RL算法者优先;
4、出色的问题分析和解决能力,能深入解决大模型训练和应用存在的问题;
5、良好的沟通协作能力,能和团队一起探索新技术,推进技术进步。
简历投递
内推链接:https://job.toutiao.com/s/NGTeeqmE51k
投递邮箱:weiran98123@163.com
地址:北京、深圳
