产品推荐 | 理想的语音大脑是什么样?来看看华镇VB590标准核心板

简介: 日前,华镇语音大脑VB590标准核心板已在OCC上线。该方案针对语音芯片行业应用场景的碎片化、推广周期长,应用场景复杂,缺乏统一语音标准等痛点,推出语音大脑VB590标准核心板,可广泛应用在智能家居,智能卫浴,智能照明,智能机电,智能玩具等场景领域。

日前,华镇语音大脑VB590标准核心板已在OCC上线。该方案针对语音芯片行业应用场景的碎片化、推广周期长,应用场景复杂,缺乏统一语音标准等痛点,推出语音大脑VB590标准核心板,可广泛应用在智能家居,智能卫浴,智能照明,智能机电,智能玩具等场景领域。

方案介绍

VB590标准核心板,采用高灵敏度模拟麦克风录音,利用稳态、动态噪音过滤算法,动态调整录音音量,录音降噪后通过语音增强,将高信噪比的语料数据送到识别引擎去做识别,保证了不同距离识别的高精准度和抗噪能力,适合远距离或嘈杂环境下真实复杂场景下的语音识别、语音控制。系统无需WiFi、无需APP并识别灵敏,内置VB590AI语音识别芯片,用于极速语音操控能力,用户可以通过语音实现和设备的交互控制,带来简单快捷的使用体验。

针对离线语音识别客制化程度高的特点,VB590方案实现SDK完全开放,自定义语音识别指令集,开发者可以连接华镇服务器训练对应的语音模型。训练方法简便,通过文本编辑的方式,就可以实现包括唤醒词在内的针对不同客户的语音模型。

四大优势让家庭控制更加智能化

【语音识别AI算法】基于第二代TDNN-LFMMI模型,识别率较第一代DNN-HMM 模型有巨大优势,提高6%以上。

【多语种声学模型】具备中文普通话、北美英语、英式英语的识别能力,能够覆盖绝大多数带方言的普通话识别场景。中文模型包括了近2万小时,英文模型包括了近1万小时。

【前端声学处理算法】支持语音增强、语音降噪、实现单麦远场识别。

【客制化服务】SDK完全开放,提供自定义识别指令集, 开发者可以连接华镇服务器训练对应的语音模型。

94C90BB1-3C04-4b9a-8E1B-949BCABC82CC.png

芯片方面

VB590采用了平头哥高性能32位处理器XT804。芯片上运行语音识别算法、语音降噪算法、语音增强算法实现了远场离线语音识别。芯片内置语音识别神经网络计算所需要的DSP指令增强单元以及MCA算法硬件加速器,AI算法与芯片架构深度融合,算力和效能之间取得非常好的平衡。

VB590芯片内置集成了128KB SRAM、2MB FlASH、ADC、DAC,外围BOM极其简单。芯片支持中文、英文离线语音指令识别、远场识别、强噪音下识别,完全是高性价比离线识别芯片同时还支持二次开发,开发者可以自定义语音识别指令,从研发到量产,提供全流程服务。

此款产品已在OCC上线,更多产品详情可扫描下方二维码查看。

C9576F8F-26C0-49b1-AF2E-EC652899C7F9.png

公司介绍

上海华镇电子科技有限公司成立于2006年,拥有近百项专利及软件著作权。是国家高新技术企业,软件企业并连续多年获得上海市双创大赛奖项,华镇拥有多项人工智能核心算法,如:声学前端的麦克风阵列(SMA)、远声降噪(NS)、回声抑制(AEC)、人工智能深度神经网络语音识别(KWS、ASR)、声纹识别(VPR)等核心算法,有着丰富的研究及项目落地的经验。华镇聚合核心算法能力推出全方位赋能百业的人工智能开放平台——语音大脑VoiceBrain开放平台,作为软硬件全链条能力的企业,华镇可以为客户提供一站式Turnkey服务,让我们的合作伙伴用最小的成本,简单、便捷的用上AI系统。

来源:芯片开放社区 微信公众号
原文链接:https://mp.weixin.qq.com/s?__biz=MzIxMDMxMDQxNA==&mid=2247484433&idx=1&sn=b9fdd9d0f53b25465208abd78a7eada1&chksm=9767c070a0104966df35cbe675d68a89fd0984d9677f8809ff81f43fae17d2ddbb6668aeec97&token=1131223069&lang=zh_CN

相关实践学习
达摩院智能语音交互 - 声纹识别技术
声纹识别是基于每个发音人的发音器官构造不同,识别当前发音人的身份。按照任务具体分为两种: 声纹辨认:从说话人集合中判别出测试语音所属的说话人,为多选一的问题 声纹确认:判断测试语音是否由目标说话人所说,是二选一的问题(是或者不是) 按照应用具体分为两种: 文本相关:要求使用者重复指定的话语,通常包含与训练信息相同的文本(精度较高,适合当前应用模式) 文本无关:对使用者发音内容和语言没有要求,受信道环境影响比较大,精度不高 本课程主要介绍声纹识别的原型技术、系统架构及应用案例等。 讲师介绍: 郑斯奇,达摩院算法专家,毕业于美国哈佛大学,研究方向包括声纹识别、性别、年龄、语种识别等。致力于推动端侧声纹与个性化技术的研究和大规模应用。
相关文章
|
Linux
【开发/调试工具】【串口工具】不同串口软件如何生成带时间戳的日志
【开发/调试工具】【串口工具】不同串口软件如何生成带时间戳的日志
3358 0
【开发/调试工具】【串口工具】不同串口软件如何生成带时间戳的日志
|
算法 Java
算法系列之回溯算法
回溯算法(Backtracking Algorithm)是一种通过穷举来解决问题的方法,它的核心思想是从一个初始状态出发,暴力搜索所有可能的解决方案,遇到正确解将其记录,直到找到了所有的解或者尝试了所有的可能为止。
598 4
算法系列之回溯算法
|
开发框架 前端开发 Swift
【Swift开发专栏】Swift与跨平台应用开发
【4月更文挑战第30天】Swift 在跨平台开发中优缺点并存,其代码复用性、高性能和易于集成是亮点,但生态系统限制和高学习成本是挑战。开发者可借助 SwiftUI、Combine 等工具,配合React Native、Flutter、Xamarin等框架实现跨平台。Swift 不是独立的跨平台框架,但能与其他框架结合使用,适用于不同项目需求。
643 0
|
索引 Python
Python中跨越多个文件使用全局变量
Python中跨越多个文件使用全局变量
528 0
Python中跨越多个文件使用全局变量
|
运维 负载均衡 应用服务中间件
[nginx]反向代理grpc
[nginx]反向代理grpc
579 0
|
XML JSON 机器人
PyMuPDF 1.24.4 中文文档(二)(2)
PyMuPDF 1.24.4 中文文档(二)
836 0
|
算法 C++
回溯算法详解
回溯算法详解
|
存储 自然语言处理 编译器
在Overleaf中解决IEEE LaTeX模板不能显示中文问题
在Overleaf中解决IEEE LaTeX模板不能显示中文问题
8161 0
|
Web App开发 JavaScript 前端开发
html img Src base64 图片显示
大家可能注意到了,网页上有些图片的src或css背景图片的url后面跟了一大串字符。 比如:data:image/png;base64, iVBORw0KGgoAAAANSUhEUgAAAA...
5372 0
|
负载均衡 Java 持续交付
微服务系列:Spring Cloud核心组件图解
微服务系列:Spring Cloud核心组件图解
4806 1
微服务系列:Spring Cloud核心组件图解

热门文章

最新文章