ICASSP 2024 论文预讲会由CCF语音对话与听觉专委会、语音之家主办,旨在为学者们提供更多的交流机会,更方便、快捷地了解领域前沿。活动将邀请 ICASSP 2024 录用论文的作者进行报告交流。
ICASSP 2024 论文预讲会第十五期邀请到罗切斯特大学AIR Lab做本次会议的专场分享,欢迎大家观看。
实验室概况
罗切斯特大学音频信息实验室(Audio Information Research Lab, AIR),由段志尧教授带领,我们的研究兴趣主要集中在计算机听觉这一新兴领域,这一领域致力于设计智能算法和系统,使之能够理解包括音乐、语音和环境声音在内的声音。这是一个跨学科领域,融合了信号处理、机器学习、心理声学、音乐理论等多个领域的知识。我们解决的基本问题包括解析多声部听觉场景(鸡尾酒会效应),以及设计新颖的应用,如声音检索和音乐信息检索。我们还将声音分析与文本和视频等其他信号模态的分析结合起来,进行多模态场景分析。我们一直在研究的各种项目包括音频源分离、自动音乐转录、音频-乐谱对齐、语音增强、语音日志记录和情绪识别、声音检索、声音事件检测和音频视觉场景理解。

第十五期
罗切斯特大学AIR Lab【专场】
时间:3月23日(周六)10:00 ~ 11:15
形式:线上
议程:每位嘉宾分享25分钟(含5分钟QA)

嘉宾&主题

嘉宾简介:臧永宜,罗切斯特大学 (University of Rochester) 音频工程专业本科毕业生,现在 Neosensory 担任机器学习工程师。臧永宜的研究兴趣在于音频信号相关的应用机器学习领域,包括多模态和空间音频,合成歌声和语音识别,及音乐信息检索方向。同时,他的工作方向主要在于轻量化的音频识别模型的开发、对大模型的压缩及端侧部署。他的研究成果已在 ICASSP, INTERSPEECH, AES, JAES 等国际知名会议或期刊上发表。他同时是一名编曲/音乐制作人。
分享主题:SynthTab: Leveraging Synthesized Data for Guitar Tablature Transcription

嘉宾简介:周恩霆,加州大学圣地亚哥分校(University of California, San Diego)电气与计算机工程系的在读硕士,本科毕业于罗切斯特大学(University of Rochester)计算机专业。他的研究兴趣在应用机器学习,特别是自然语言处理和语音处理方面。他的研究成果在ICASSP,IEEE Big Data上发表。他还通过在亚马逊公司的实习,继续探索机器学习在工业级的大规模应用和部署。

嘉宾简介:张优,罗切斯特大学(University of Rochester)电气与计算机工程系的在读博士生。张优的研究兴趣在应用机器学习,特别是语音与音频处理方面。他的研究课题涵盖音频鉴伪、空间音频和音视频多模态分析等。他的研究成果已在ICASSP、Interspeech、WASPAA、SPL、TMM等国际知名会议及期刊上发表。张优在ICASSP2023的信号处理新星计划中获得表彰,并获得国家司法研究所(National Institute of Justice)的研究生奖学金。他还通过在字节跳动、腾讯和微软等公司的实习,将他的研究成果成功应用于实际问题。
直播将通过语音之家微信视频号进行直播

讨论群

扫码添加语音小管家,进入语音之家讨论群

为了共创高质量的论文预讲会,我们诚挚邀请所有 ICASSP 2024 作者参与到此次预讲会活动中来,也欢迎大家推荐适合此次预讲会活动的学者。
联系人邮箱
bd@speechhome.com
联系人微信

