近日,由腾讯音乐娱乐集团(TME)主办的音乐娱乐技术盛会“TechME技术周”在深圳成功举办。本次会议以“Rock N Code,让技术发声”为主题。  会议中由TME技术领域专家、音乐行业优秀技术团队和语音界大咖对技术成果进行了分享,同时共同探讨了科技对音乐产业带来的变革,下面是本次盛会的回顾。


大咖分享


谢磊
西北工业大学教授


分享主题:智能语音技术的前沿与发展趋势

分享内容:重点分享了语音增强、语音识别、语音合成等技术前沿课题。

嘉宾介绍:谢磊,西北工业大学教授,博导,西工大音频语音与语言处理实验室(ASLP@NPU)负责人。曾在比利时布鲁塞尔自由大学、香港城市大学和香港中文大学从事研究工作。获得教育部"新世纪优秀人才支持计划",陕西省青年科技新星、西安市青年科技奖等荣誉。


夏光宇
上海纽约大学计算机科学助理教授

分享主题:Music AI-从人类智障到机器智能

分享内容:重点分享“音乐智能”相关前沿技术探索和研究方向,将人工智能和艺术结合,利用技术服务于人类。


嘉宾介绍:夏光宇,现任上海纽约大学计算机科学助理教授、纽约大学全球特聘助理教授,并在纽约大学坦登工程学院担任职务,卡内基梅隆大学机器学习博士。擅长笛箫演奏,研究方向为计算机音乐、人工音乐智能。

自幼修习笛艺,始得魏显忠先生启蒙,后随张维良教授深造,十四岁获中国三北地区汇演金奖,十九岁获全国民族器乐专业考评第一名。于是入北京大学信息管理系攻读本科,并加盟北京大学笛箫学社,后任社长。

年二十三赴美留学,合专业志趣为一,以计算机音乐为研究方向,于卡内基梅隆大学攻读计算机博士,师从自动伴奏创始者Roger Dannenberg,试以人工智能创造人机互动之全新演奏模式。



夏光宇
上海纽约大学计算机科学助理教授

分享主题:Music AI-从人类智障到机器智能

分享内容:重点分享“音乐智能”相关前沿技术探索和研究方向,将人工智能和艺术结合,利用技术服务于人类。

嘉宾介绍:夏光宇,现任上海纽约大学计算机科学助理教授、纽约大学全球特聘助理教授,并在纽约大学坦登工程学院担任职务,卡内基梅隆大学机器学习博士。擅长笛箫演奏,研究方向为计算机音乐、人工音乐智能。

自幼修习笛艺,始得魏显忠先生启蒙,后随张维良教授深造,十四岁获中国三北地区汇演金奖,十九岁获全国民族器乐专业考评第一名。于是入北京大学信息管理系攻读本科,并加盟北京大学笛箫学社,后任社长。

年二十三赴美留学,合专业志趣为一,以计算机音乐为研究方向,于卡内基梅隆大学攻读计算机博士,师从自动伴奏创始者Roger Dannenberg,试以人工智能创造人机互动之全新演奏模式。


嘉宾介绍:吴志勇,清华大学深圳国际研究生院副研究员,博士生导师。清华大学-香港中文大学媒体科学、技术与系统联合研究中心副主任。研究兴趣为面向人工智能的智能言语交互技术,包括:智能语音交互、情感计算、表现力可视语音合成、自然语言理解与生成、音视双模态联合建模,机器学习等。发表学术期刊及会议论文100余篇。中国计算机学会语音对话与听觉专业委员会委员,全国人机语音通讯学术会议常设机构委员,国家自然科学基金网评专家。承担国家自然科学基金、香港特区政府研究资助局基金、国家社会科学基金等多项课题。获2009及2016年度教育部科学技术进步奖。



燕楠
中国科学院深圳先进技术研究院研究员,博士生导师
分享主题:古典音乐生成初探---深度学习在音乐生成里的应用
分享内容:主要分享了AI作曲在音乐生成中的应用。


嘉宾介绍:燕楠,博士,中国科学院深圳先进技术研究院研究员,博士生导师。2009年于西安交通大学生物医学工程系取得博士学位,2009年-2012年在香港大学言语与听觉科学系从事博士后研究工作,主要研究领域为语音信号处理与人工智能、病理语音的人工智能系统、音乐质量客观评估与智能化言语康复技术。近五年来,主持科技部重点研发计划课题、国家自然基金青年项目,国家自然基金面上项目和深圳市科技研发资金项目基础学科布局计划项目等多个省部级项目,作为核心骨干参与国家自然基金重点项目、科技部变革性技术等重大项目,获批经费超过1000万元,是中国科学院人机协同智能系统重点实验室和深圳市言语治疗与康复技术工程实验室核心成员。以第一作者和通讯作者在《Human Brain Mapping》、《Movement Disorders》、《Journal of Neurosciense》、《Lang. Cogn Neurosci.》、《Journal of Child Language》等国际知名期刊会议上发表SCI/EI论文60余篇,申请专利12项,授权6项。现在担任IEEE TASL、IEEE TBME、JSHLR等10余个知名SCI杂志的特约审稿人。


音频团队分享

-1-

分享主题:下一代歌曲识别技术

个人简介:Lester,高级应用研究员,本硕毕业于华南理工大学,2014年以来在腾讯音乐从事音乐音频相关开发与研究,近几年专注于音乐识别技术的迭代与研发。


演讲主题介绍:分析当前听歌识曲面临的挑战以及团队探索的解决方案,畅想音乐识别的技术前景。


-2-

演讲分享主题:AI技术在智能修音上的探索

个人简介:Aaron,高级应用研究员,专注于语音合成、歌声合成和歌声分离等音频AI技术研发


演讲主题介绍:不同于基于变速变调传统修音方案,本次分享将提出业界首创的AI修音技术,介绍AI技术如何让每个人都成为“歌神”。


-3-

分享主题:基于深度学习的音乐超分辨率

个人简介:Shichao,高级应用研究员,本科、博士分别毕业于北邮和日本东北大学,2019年加入腾讯音乐。


分享主题:基于深度学习的音乐超分辨率

个人简介:Shichao,高级应用研究员,本科、博士分别毕业于北邮和日本东北大学,2019年加入腾讯音乐。


视频团队分享

-1-

分享主题:移动端实时视频质量提升技术

个人简介:Guowei,高级应用研究员,本科博士毕业于香港理工大学,2020年加入腾讯音乐。


演讲主题介绍:本次分享视频质量提升在K歌和QQ音乐的最佳实践: 业界常用的直播视频质量提升技术方案, 包括服务器端和移动端的解决方案, 以及QQ音乐/全民K歌技术团队在该领域研发过程中取得的一些经验和成果。


-2-

分享主题:音乐视频化之路

个人简介:Junxin,高级应用研究员,本科毕业于中山大学,硕士毕业于香港大学,拥有多年ARVR以及计算机视觉算法的研发经验。2020年加入TME,负责视频化业务


演讲主题介绍:从专辑,流媒体,到短视频,音乐的宣发方式随着时代快速转变,视频化已经是在线音乐行业的大势所趋。本次分享将为大家介绍天琴实验室自研的视频化解决方案之一:PortrAIt视频竖版剪辑技术,其中涉及多个计算机视觉任务的综合运用。相较于业界常规的视频横版视频转竖版的方法,我们的自研方案对音乐视频场景做了针对性的优化。此外,本次分享也将介绍我们在音乐视频化方向上更进一步探索的经验和成果。


尾 声

TME天琴实验室致力于对业内前沿科技如AI等方向进行相关研发,持续推出新技术提升TME旗下QQ音乐等平台的音乐视听体验,其从前身“QQ音乐多媒体研发中心”升级而来。自创立以来,天琴实验室不断攻坚创新,在音频、视频技术领域成绩斐然,已收获包括384个专利技术,Mirex音频指纹大赛冠军等多个国内外音视频重量级奖项,以及有多项论文被收录于INTERSPEECH、ICASSP、IJCNN等各大国际论坛组织的成就。天琴实验室不仅展示着他们对探索“音乐星空”的不懈追求,更秉持着以科技向善为使命,切实用具有温度的前沿技术,为用户带来了如听歌识曲、AI智能剪辑等用于听歌与刷视频的实用黑科技,为用户提供更美好的音乐娱乐体验。