(资料图)
IT之家 4 月 10 日消息,美国康奈尔大学的研究人员开发了一种新技术,可以通过声纳眼镜进行无声沟通。这种眼镜利用微型扬声器和麦克风来读取佩戴者默念的单词,从而可以在不需要物理输入的情况下执行各种任务。
这项技术由康奈尔大学的博士生张瑞东(音译)领导开发,是在一个类似的项目的基础上进行的改进,该项目使用了一个无线耳机,而之前的模型则依赖于摄像头。
据IT之家了解,该声纳眼镜使用一种名为 EchoSpeech 的无声语音识别接口,利用声纳来感知嘴部运动,同时使用一个深度学习算法实时分析回波特征。这使得系统能够以约 95% 的准确率识别佩戴者默念的单词。
这项技术最令人兴奋的前景之一是,对于有语言障碍的人来说,可以使用它来无声地将对话输入到语音合成器中,然后将单词大声说出来。眼镜也可以用来在安静的图书馆中控制音乐播放,或者在嘈杂的音乐会上口述信息。
该技术既小巧又低功耗,也不会侵犯隐私,因为没有数据离开用户的手机。这样,就不会有隐私方面的担忧。眼镜佩戴非常方便,比其他可用的无声语音识别技术更实用、更可行。
研究人员表示,该系统只需要几分钟的训练数据来学习用户的语音模式,学习完成后,就可以朝用户的脸上发送和接收声波,感知嘴部运动,同时使用深度学习算法分析回波特征。该系统目前能够识别 31 个孤立的命令和一串连续的数字,并且错误率低于 10%。
该系统目前的版本提供了大约 10 小时的电池续航,并且可以通过蓝牙无线地与用户的智能手机通信。智能手机负责处理和预测所有数据,并将结果传输到一些“动作键”,让它可以播放音乐、与智能设备交互或激活语音助手。
康奈尔大学智能计算机接口未来交互(SciFi)实验室正在利用康奈尔大学的一个资助计划来探索将这项技术商业化的可能性。
标签:
-
即时焦点:iPhone 15 ProMax预计售价2万块,外形图已被曝光据快科技报道,消息称苹果今年依然会带来四款iPhone15机型,...
-
全球今头条!“礼多多盲盒”关闭无法提现,警方:涉嫌集资诈骗4月9日,山东省临沂市公安局兰山分局发布通报称,经调查,山...
-
观焦点:周杰伦就不正当竞争起诉网易,4月17日开庭天眼查数据显示,近日,广州网易计算机系统有限公司、网易(杭...
-
环球短讯!三六零一度触及跌停,成交额超68亿元今日上午,三六零一度触及跌停,成交额超68亿元。4月4日,三...
-
元宇宙房产崩盘:暴跌近90%,林俊杰等投资者亏钱元宇宙分析平台WeMeta的数据显示,2017年元宇宙每平方米土地...
-
环球报道:经济日报:热捧人工智能需防泡沫据经济日报文章指出,当前ChatGPT在应用场景和商业化探索上还...
-
焦点短讯!360GPT大模型产品矩阵“360智脑”将面向企业用户开放内测三六零宣布,基于360GPT大模型开发的人工智能产品矩阵“360智...
-
天天讯息:麦当劳公司从本周开始进行重组,已有数百人被裁员根据多家美国媒体报道,麦当劳公司从本周开始进行重组。截至...
-
浪潮信息:AI服务器需求爆增,正规划更大规模液冷基地据财联社报道,近日走访浪潮信息天池液冷产业基地获悉,AI算...
-
全球新资讯:暴雪战网遭遇DOSS攻击,多款游戏无法正常登录据媒体报道,暴雪战网在昨日晚至今日上午遭遇DOSS攻击。此次D...
- 智联世界,元生无界!快手虚拟人IP亮相2022人工智能大会
2022-09-07 10:47:54
- 机器人界“奥林匹克”!2022世界机器人大会8月18日举行
2022-08-10 09:58:58
- 2025年全球人口将达到90亿!机器人将在农业领域大显身手
2022-07-14 09:41:10
- 中科院院士蒋华良:AI+分子模拟与药物研发将大有可为
2022-07-14 09:37:00
- “千垛之城荷你有约” 2022兴化市荷文化旅游节正式开幕
2022-07-07 09:28:34