Xmart青年论坛由上海交通大学跨媒体语言智能实验室(SJTU X-LANCE lab)创办,中国计算机学会语音对话专委会主办,语音之家协办,旨在邀请国内外优秀的青年学者分享其最新科研工作和成果,促进多元且深入的交流与合作。Xmart学生论坛作为其中一个系列,致力于邀请国内外知名高校有成体系工作的研究生,主要通过线上分享的方式,系统地介绍其科研成果和心得,为青年学生打造一个学术探讨,思维碰撞和多学科交叉融合的平台。


Xmart•学生论坛丨周俊佐、任勇:语音的可溯源保护:音频水印研究

形式:线上

时间:4月24日(周四) 14:00 ~ 17:00


报告嘉宾

周俊佐,中科院自动化研究所陶建华老师和易江燕老师二年级硕士生。研究方向为音频水印,语音离散化表征,语音合成等。以第一作者身份在ICASSP, Interspeech等会议和期刊上发表多篇论文,累计引用150+。

任勇,中科院自动化研究所陶建华老师和易江燕老师五年级博士生。研究方向为语音离散化表征,语音合成,音频水印等。曾在AAAI,ACL,ACM MM,ICASSP,Interspeech等国际会议上发表多篇论文。


报告摘要

最近,国家网信办等部门联合发布了《人工智能生成合成内容标识办法》,以规范AIGC的发布和使用,维护社会公共利益。音频水印作为一种可以标识生成语音,使其可溯源的关键手段,吸引了大家的关注。本次分享将回顾音频水印的发展,围绕三类音频水印方法,通用Post-hoc音频水印、任务融合音频水印和开源模型音频水印,介绍相关的代表工作,以及我们在音频水印方向的最新探索。具体而言,我们将首先以 WavMark 和 AudioSeal 为代表的通用音频水印为切入,总结音频水印的基本要素;随后引出任务协同水印建模思路,包括声码器和水印嵌入及检测联合建模的方法Collaborative Watermarking,以及我们将Codec和水印嵌入与追溯联合建模的工作TraceableSpeech 和 WMCodec ,展示语音合成等专有任务驱动下的水印设计;进一步地,针对语音生成模型的开源化趋势,我们将介绍 Latent Watermarking、HiFi-GANw ,以及我们提出的插件式参数内在音频水印方法 P2Mark,探讨在模型源代码与权重开源下进行水印标识和版权保护的思路。最后,结合未来需求与技术演进,我们将探讨音频水印未来发展中的问题与挑战。

参加方式

①

直播将通过语音之家微信视频号进行直播

手机端、PC端可同步观看

👇👇👇

②

腾讯会议参加

会议号:637-196-786