聚能聊每周精选<第一期>

2017-12-13 2489

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 本周热议，达摩院黑科技首次亮相，语音让生活变的更简单！AIOPS是什么，它的未来如何？工业的顶级化发展就是人工智能，人工智能在工业界的落地又如何呢？TensorFlow你了解多少，一起来聊聊吧！

聚能聊每周精选 <第一期>

本周热议——达摩院黑科技首次亮相，语音让生活变的更简单！

传统的自然语音交互主要在家居、办公室等比较安静的环境下工作，但在公众场所嘈杂环境下，业界此前尚无可以达到大规模商用水平的远场语音交互整体解决方案。iDST首次创新研发了基于深度学习的大型麦克风阵列技术，结合深度优化的声学结构和多模态融合技术，能够自动从强干扰背景语音中提取出目标说话人的语音，并实现增强，从而突破了嘈杂干扰环境下远场语音识别的世界性难题。其次市场上主流远场语音交互产品，都需要通过“唤醒词+语音指令”的方式进行交互。而这次iDST通过“语音+视觉”多模态融合技术，能够自动检测用户走近设备的行为，主动发起交互。此外，通过这一技术还实现了免唤醒的语音交互体验，使人-机交互更接近人-人交互的自然和流畅。点击查看。

相关实践学习

达摩院智能语音交互 - 声纹识别技术

声纹识别是基于每个发音人的发音器官构造不同，识别当前发音人的身份。按照任务具体分为两种：声纹辨认：从说话人集合中判别出测试语音所属的说话人，为多选一的问题声纹确认：判断测试语音是否由目标说话人所说，是二选一的问题（是或者不是）按照应用具体分为两种：文本相关：要求使用者重复指定的话语，通常包含与训练信息相同的文本（精度较高，适合当前应用模式）文本无关：对使用者发音内容和语言没有要求，受信道环境影响比较大，精度不高本课程主要介绍声纹识别的原型技术、系统架构及应用案例等。讲师介绍：郑斯奇，达摩院算法专家，毕业于美国哈佛大学，研究方向包括声纹识别、性别、年龄、语种识别等。致力于推动端侧声纹与个性化技术的研究和大规模应用。

聚能聊每周精选<第一期>

聚能聊每周精选 <第一期>

热门文章

最新文章

相关电子书

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

聚能聊每周精选<第一期>

聚能聊每周精选 <第一期>

热门文章

最新文章

相关电子书