QuarkAudio: 基于语义声学解耦离散表征的音频编辑与生成大模型
近日,千问C端AI人机交互团队联合通义实验室在音频大模型领域取得重要进展,正式开源QuarkAudio:一个面向端到端音频处理与生成的统一建模框架。QuarkAudio基于离散化音频表征实现了对语音修复、音频生成与编辑等多样化任务的统一建模…
49 0 0
近日,千问C端AI人机交互团队联合通义实验室在音频大模型领域取得重要进展,正式开源QuarkAudio:一个面向端到端音频处理与生成的统一建模框架。QuarkAudio基于离散化音频表征实现了对语音修复、音频生成与编辑等多样化任务的统一建模…