打破智能语音技术壁垒,炬芯用芯助力新交互

2019-11-21 17:39:06 来源:中华网
        【每日科技网】

  谈到智能语音,早已不是什么新鲜的事情,国外有苹果Siri,微软小娜,Google Assistant,亚马逊的Alexa这样的智能语音大咖。国内有灵犀助手(科大讯飞),小度(百度),小爱同学(小米)这样的后来跟进者。

  接触智能语音的用户,会觉得很神奇,觉得这东西怎么可以如此智能。而对于经常使用的老用户来说,智能语音助手的鸡肋日益显现,因为现阶段的智能语音基本都是采用数据库匹配的原则,对于云端数据库中没有的知识,智能语音也只能“呵呵”了。不难看出的是,智能语音设备的拾音技术依然收外界许多因素干扰,进步和优化空间巨大。但,对于技术来说,我们应该永远怀着宽容和理解的态度去对待,因为任何一门技术都是一个不断积累和迭代的过程。

  对于大部分人来说,目前接触体验最多的智能语音硬件应该只有智能音箱和智能机器人。只有通过智能硬件与云端数据中心的默契配合,才有可能让智能语音交互形成完整通路。语音交互的大致流程可分为:声音采集—>降噪—>语音唤醒—>语音转文字—>语义理解—>回复文字和指令—>文字转声音—>播放声音。以下天猫精灵智能音箱为例,将语音交互完整步骤做逐步分解。

  1.用户说“天猫精灵,今天天气怎么样?”;2、“天猫精灵”被语音唤醒模块接收到,并判断为唤醒词,然后通过AI芯片和硬件拾取和记录“今天天气怎么样”这段语音,并发送给云端服务器;3、服务器把收集到的电脑信号,再次转化成文字“今天天气怎么样”,交给语义理解服务器;语义理解服务器把“今天天气怎么样”这段文字,拆解成“事件=查询天气,时间=今天”这段控制指令回传给设备。4、设备根据时间和本机地理位置,找天气服务器查询天气,并获得天气的的文本数据“今天要下雨”;5、设备把“今天要下雨”这几个字发给文字转声音的服务器,服务器返回“今天要下雨”这段声音,由设备喇叭播放出来。

  毋庸置疑的是,以上五个步骤都是由智能音箱的硬件和云端的数据中心配合完成的,硬件只要负责声音的拾取和传达,云端则用丰富的数据资源去匹配用户的需求,二者缺一不可。相对来说,声音前处理技术则是智能硬件最最重要的部分,主要体现降噪和拾音效果两方面,唤醒以及与机器对话的时候都需要拾音,而且拾音还有近距离和远距离之说,如果连最基本的声音都没有听清和听懂,谈何后面的数据传达和解析呢。

微信图片_20191029140503.png

  声音的前处理技术,是声音没有进入传输、没有存储之前的处理。声音前处理目的,就是让声音的存储、传输效率更高,识别率更好(例如回声消除、降噪、声音活动检测等等)。声音的后处理技术,是声音经过存储之后进行播放的同时处理。是对音源例如 MP3 等媒体解码播放的声音进音效增强处理(例如虚拟重低音、环绕立体声、高音增强、EQ 等等)。如何将人的声音有效传达至机器,让机器“听到”、“听清”且“听懂”? “听懂”之后又改如何与云端的数据进行精准匹配,最终反馈给用户真正想要的需求动作?这将是智能语音声音前处理技术和声音后处理技术应该思考和努力解决的问题。国内耕耘声音20余年,在声音前处理技术方面已经处于地位的国产芯片原厂炬芯科技从2018年开始就在核心主推的双麦克风阵列智能语音芯片,已经在各大品牌智能音箱、早教机器人、绘本机器人、物联网中控等产品上完美落地,强大的声音前处理技术为完美智能语音体验保驾护航。后续将推出更高端的ATS3609D等高端语音及视频交互解决方案,对声音的耕耘炬芯将永无止境。

image007.jpg

  目前,国家正在加快人工智能的产业布局,发布多项利好政策促进人工智能产业发展;5G时代的来临更是为人工智能的发展培育了一片物联网沃土。我们可以预见,智能语音作为下一代人机交互的新入口,将率先在这片人工智能的沃土上生根发力,推动整个产业的茁壮成长。如想让让智能语音产品做到真正的聪明,智能硬件(包括主控芯片和各种IC)和语音助手(云端数据中心)都需要再升级,不断打通人和机器之间对话的技术壁垒,让人与机器中间的沟通变成真正的“面对面”沟通。

免责声明:本文仅代表作者个人观点,与每日科技网无关。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
    本网站有部分内容均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责,若因作品内容、知识产权、版权和其他问题,请及时提供相关证明等材料并与我们联系,本网站将在规定时间内给予删除等相关处理.

猜你喜欢

千匠网络实践:如何让大模型从“能用”走向“好用”

过去两年,几乎所有上规模的企业都接入了大模型。智能客服、知识问答、AI助手——这些应用已经算不上新鲜事。但在演示会议室与真实业务场景之间,一个显著落差正在浮现:能聊天,但不理解企业业务语境;能生成内容

千匠网络

7天前

海能达发布全新专业防爆PDT对讲机CH690Ex

随着我国应急管理体系持续完善,消防救援任务正在从传统火灾处置,向化工园区事故、危险品泄漏、地下空间救援、大型综合灾害等多风险、多场景方向发展。在这些复杂环境中,救援现场往往面临爆炸性气体、可燃性粉尘、

3周前

海能达CCW 2026载誉收官:AI与融合通信引领专用通信新未来

6月16日至18日,2026年全球关键通信展(CCW2026)在英国伦敦举行。展会期间,海能达集中展示了从终端到系统、从感知到决策的全链路创新版图,AI与融合通信产品及解决方案贯穿三天展期,持续获得高

1个月前

登陆欧洲 Intersolar!远景AI电力系统支撑全球 AI 算力发展

慕尼黑,2026年6月23日——在IntersolarEurope2026上,远景科技集团发布面向AI数据中心的下一代电力基础设施——融合风光储一体化方案、固态变压器(SST)、800V直流供电、储能

1个月前

海能达六度问鼎ICCAs,PDC650与西安机场方案摘得双奖

6月17日,2026年国际关键通信奖(InternationalCriticalCommunicationsAwards,ICCAs)在英国伦敦举行的全球关键通信展(CCW2026)期间正式揭晓。海能

1个月前

海能达即将亮相2026年CCW全球关键通信展: 携AI与融合通信解决方案登陆伦敦

6月16日至18日,2026年CCW全球关键通信展将在英国伦敦启幕。作为全球领先的专用通信解决方案提供商,海能达将以全场景关键通信产品矩阵亮相F25展位,集中展示面向公共安全、应急救援、城市治理等领域

1个月前