来源丨微信公众号:低调奋进
论文统计每月更新一次,主要跟踪语音合成和语音识别的发展状况。很多文章都是在会议后才发出,但不影响统计。统计过程难免存在疏漏,因此统计结果仅供参考。
所有文章语音合成领域统计列表请访问:http://yqli.tech/page/tts_paper.html
语音识别领域论文统计请访问:http://yqli.tech/page/asr_paper.html
开源语音数据查询:http://yqli.tech/page/data.html
如何查找语音资料请参考文章:https://mp.weixin.qq.com/s/eJcpsfs3OuhrccJ7_BvKOg
文章统计excel :https://docs.google.com/spreadsheets/d/11YYOg6i6UXw19_g1JRaXGNhvt1zhG24RgOXCzZlqZGE/edit?usp=sharing
表一给出具体分类说明。2022年9月的语音合成相关的文章有31篇,相比8月份增加不少(详情见图1),同时也比去年的9月增加很多。表二和图2是语音合成的具体方向文章的情况。本月的文章在声学模型、歌唱、声音转换和多模态较多一些。(最近正在整理纯端到端的系统,有空写篇总结文章,语音合成学术和生产环境进入完全端到端的时代)

表二 语音合成论文分布情况

图2 语音合成论文分布情况柱状图


2022.09月份的文章

| robust | 鲁棒性 |
| speaker diarization | speaker diarization |
multichannel | 多通道 |
| speech translation | 语音翻译 |
| multi-modal | 多模态 |

表4 语音识别研究方向分布情况

图4 语音识别研究方向柱状图


2022.09月份语音识别具体文章

