面向听觉智能与物理AI的
人机交互开发者社区

发现模型、参与赛事、分享实践、连接同行,共创数据、模型与评测驱动的人机交互生态。

50k+
注册开发者
5.8k+
技术文章
268+
开源数据集
300+
技术课程

最新声浪

查看全部 →
Kaldi的三音子模型训练(源码解析)
转载6 years ago
Kaldi的三音子模型训练(源码解析)

单音子模型的假设是一个音素的实际发音与其左右的音素无关。这个假设与实际并不符合。由于单音子模型过于简单,识别结果不能达到最好,因此需要继续优化升级。就此引入多音子的模型。最为熟悉的就是三音子模型,即上下文相关的声学模型。以kaldi的thc…

228 0 0
语音分享_1225
原创6 years ago
语音分享_1225

语音分享系列继续来袭,这次带来几个开源的工程。 1.OpenTransformer 正坤同学最近把OpenTransformer里加入里conformer模型,在aishell测试上效果刚刚,conformer模型基本成为继transfor…

23 0 0
人机交互新突破:多模态交互技术
转载6 years ago
人机交互新突破:多模态交互技术

近年来服务机器人逐渐进入商场、银行、机场等场所,但多数服务机器人仅能被动响应用户的请求,且使用和交互的频率非常低,也就成为了“移动平板电脑”。 为此,百度的工程师们率先在小度机器人(DuRobot)上开展了一项技术革新。小度机器人落地于百度…

151 0 0

为语音开发者而生