学校与实验室介绍

香港理工大学 (The Hong Kong Polytechnic University) 是一所位于中国香港的公立综合性研究型大学, 坐落于香港九龙红磡湾。在2024-25年度,香港理工大学位居QS世界大学排名第57位,US News世界大学排名第67位,THE世界大学排名第87位。同时,香港理工大学在最新的世界大学数据科学与人工智能专业排名中名列前茅,QS排名32, US News排名32。

MIND实验室(www.mindlab-ai.com),隶属于香港理工大学数据科学与人工智能系,专注于人工智能的基础研究及其在语音信号处理,材料科学,医疗保健和机器人等多个领域的应用。团队近年来荣获多项国际奖项,包括2024 IEEE Conference on Artificial Intelligence Best Paper Award, 2023 Intel Neuromorphic Deep Noise Suppression Challenge冠军,IEEE Computational Intelligence Magazine Outstanding Paper Award(2019年和2024年),IEEE Transactions on Cybernetics Outstanding Paper Award(2020年),IEEE Transactions on Neural Networks and Learning Systems Award(2016年),以及2018年国际大学生类脑计算大赛一等奖。

更多内容请查看MIND实验室主页:www.mindlab-ai.com

导师简介

Prof. Kay Chen TAN (陈家进教授):现任香港理工大学数据科学与人工智能系讲席教授及代理系主任。他是IEEE Fellow,同时担任IEEE计算智能学会副会长,他曾在2015-2020年担任IEEE Transactions on Evolutionary Computation(影响因子:14.3)主编,2010-2013年担任IEEE Computational Intelligence Magazine(影响因子: 9.0)主编。他目前还担任了Springer Book Series on Machine Learning: Foundations, Methodologies, and Applications的联合主编。陈教授目前已经发表了8本专著以及300多篇经同行评审的期刊论文,谷歌学术引用量28,000余次(H-index:84)。

吴冀彬博士:现任香港理工大学数据科学与人工智能系及电子计算学系助理教授。他曾于2016年和2020年在新加坡国立大学取得学士和博士学位,并于2021-2022年在Sea AI Lab(SAIL)担任研究科学家。他的主要研究方向包括类脑计算、语音信号处理以及机器学习,其相关研究工作多次发表在人工智能和语音信号处理领域国际顶级会议及期刊上,包括NeurIPS、ICLR、AAAI、TPAMI、TNNLS、TASLP、TCDS、IEEE JSTSP等。他曾带领团队获得2024 IEEE Conference on Artificial Intelligence Best Paper Award, 2023 Intel Neuromorphic Deep Noise Suppression Challenge冠军以及国际大学生类脑计算大赛一等奖(2018年)和二等奖(2019年)。他目前担任IEEE Transactions on Neural Networks and Learning Systems和IEEE Transactions on Cognitive and Developmental Systems副主编。

吴郁杰博士:现任香港理工大学电子计算学系研究助理教授。他曾于2021年在清华大学获得博士学位,导师为施路平教授和朱军教授,并在2021年至2024年期间在Wolfgang Maass教授组进行博士后研究。他的主要研究方向包括类脑计算和计算神经科学,其相关研究成果在Nature(封面)、Science Robotics(封面)、Nature Computational Science、Nature Communications、TNNLS,AAAI等国际权威期刊和会议上,包含2篇ESI 1%高被引论文;谷歌学术引用4000余次,拥有相关专利3项。目前,他担任Frontiers in Neuroscience审稿编辑及CIS-RAM 2024 Conference副主编。

招聘岗位(研究课题)

单/多通道语音信号处理

MIND实验室正在寻找具有语音信号处理研究经验的全奖博士生(全年均可入学)和博士后,共同设计和开发基于麦克风阵列的回声消除/抑制、降噪、去混响、说话人分离和提取等深度学习模型。我们将提供专业的声学实验室、充足的GPU计算资源以及相应的硬件设备。

我们期待您:

•拥有音频、语音或声学信号处理领域的科研或工作经验

•对助听器或听力辅助设备相关算法以及听觉现象感兴趣

•在深度学习领域有科研或工作经验,熟练使用至少一种深度学习框架

•若有在相关领域顶尖会议或期刊发表论文,获得国际竞赛奖项,或在开源社区有重大贡献的经历,将受到优先考虑

多语种语音识别

MIND实验室正在寻找拥有语音识别经验的全奖博士生(全年均可入学)和博士后,共同设计和开发多说话人多语种语音识别系统。我们将提供真实场景数据集,专业的声学实验室,充足的GPU 计算资源。

我们期待您:

•拥有音频、语音或声学信号处理领域的科研或工作经验;若在说话人分割或语音识别方向上有相关经历,将获得优先考虑

•熟练掌握Python或C++中的至少一种编程语言,并具有使用相关语音处理库(如Kaldi, ESPnet)的经验

•若有在相关领域顶尖会议或期刊发表论文,获得国际竞赛奖项,或在开源社区有重大贡献的经历,将受到优先考虑

大语言模型驱动的智能语音信息处理

我们正在寻找对大语言模型、自然语言处理和语音技术有深入了解的全奖博士生(全年均可入学)和博士后,共同设计和开发基于文字引导的可控音乐/环境音频/语音生成和编辑系统,多模态语言模型,以及其它任何基于大模型的下游语音系统。

我们期待您:

•拥有语音信号处理、自然语言处理、计算机视觉或相关领域的科研或工作经验

•对分布式计算框架以及训练/微调/推理的性能调整和验证有深入的了解。熟悉PEFT、RL、MoE、CoT或Langchain者优先

•具备良好的编程能力和算法设计能力,熟练运用Python及相关深度学习框架

•若有在相关领域顶尖会议或期刊发表论文,获得国际竞赛奖项,或在开源社区有重大贡献的经历,将受到优先考虑

音视频多模态算法

MIND实验室正在寻找对音视频多模态算法研究感兴趣的全奖博士生(全年均可入学)和博士后,共同探索语音信号处理和计算机视觉技术的结合,研究内容包括构建可用于真实场景的音视频多模态数据集,音视频语音增强与说话人分离,以及音视频说话人分割与语音识别。我们将提供行业领先的音视频采集设备(如 Tobii Pro Glasses 3),专业的声学实验室,以及充足的 GPU 计算资源。

我们期待您:

•在音视频多模态领域拥有科研或工作经验

•在深度学习领域有科研或工作经验,熟练使用至少一种深度学习框架

•若对数据处理、特别是对音视频数据处理有深入理解,将受到优先考虑

•若有在相关领域顶尖会议和期刊发表论文,获得国际竞赛奖项,或在开源社区有重大贡献的经历,将受到优先考虑

简历投递

请感兴趣的同学将个人简历及有关申请材料(如在校成绩单排名、GRE/TOEFL/IELTS成绩证明、发表论文、获奖证明等)发送至邮箱jibin.wu@polyu.edu.hk

请大家按照如下格式来编辑邮件主题:意向岗位+姓名+毕业学校+毕业专业+语音之家推荐。

博士生奖学金介绍


更多内容可访问学校招生主页:

https://www.polyu.edu.hk/comp/study/research-postgraduate-programme/phd-and-mphil-in-computing/