随着AI音频处理工具不断向在线化发展,一些原本需要借助专业音频软件完成的任务,如人声分离、伴奏制作和音乐分轨,如今已经可以直接通过浏览器完成。Tunii近期推出了一系列基于浏览器的AI音频工具,面向人声分离、伴奏制作、音乐分轨以及视频音频处…
声浪
2026年8月4日,全球知名开源多媒体框架FFmpeg正式发布了9.0版本。 这次发布,除了例行的性能跃升、新编解码器支持与硬件加速优化之外,最令中国音视频开发者动容的,是写在发布日志最前方的版本代号:“Lei”。 这个名字,来自中国音视频…
以下文章来源:电影声音网 欧盟《人工智能法案》透明度要求已于2026年8月2日生效。 如果你正在使用人工智能对面向欧盟受众的作品进行音频、对话或视频的编辑、修改或生成,那么无论你身处何地,本周末生效的披露规则都将适用。以下是摘要。 01、欧…
近日,语音 AI 初创公司 Rime 宣布完成 2400 万美元 A 轮融资。本轮由知名风投机构 M13 领投,Twilio Ventures、Corazon Capital、Unusual Ventures 和 Cadenza Ventu…
来源丨小米公司 近日,国际语音通信协会(ISCA)正式公布 2026 年 ISCA Fellow 名单,Daniel Povey 凭借其在语音识别声学建模、序列训练创新方法、开源语音工具 Kaldi 以及对全球语音通信领域的深远贡献成功入选…
全球研究者注意:论文预印本上传平台 arXiv 又出新规了! 今天凌晨,俄勒冈州立大学杰出教授(荣休)、arXiv 计算机科学分区 CoRR 的机器学习板块首席版主 Thomas G. Dietterich 宣布:根据我们的行为准则,在论文…
🎯中文口语语言处理国际会议 International Symposium on Chinese Spoken Langauge Processing (ISCSLP) 会议时间:2026年11月14-17日 会议地点:马来西亚·槟城 往…
来源丨机器之心 OpenAI 要略过 GPT-5.3,直接迈向 GPT-5.4 了? 近日,一名 OpenAI 工程师在公开的 Codex GitHub 仓库中提交了一则拉取请求(PR),无意间让 GPT-5.4 这一型号出现在代码版本判断…
AI 音频初创公司ElevenLabs在 D 轮融资中筹集了 5 亿美元。 据报道,此轮融资使这家初创公司的估值达到 110 亿美元,比一年前的估值增长了三倍多。 本轮融资由红杉资本领投,其合伙人安德鲁·里德(Andrew Reed)加入…
来源丨AI音频时代 OBSBOT 宣布全球发布两款全新 AI 4K 网络摄像头:Tiny 3 与 Tiny 3 Lite。 Tiny 3 系列面向内容创作者、主播、播客、远程办公、教育者等群体,为专业网络摄像头树立新标杆。 两款产品集录音室…
