当前位置:首页 > 科研成果库

人机交互技术:我们离「看不见的交互」还有多远

2026-09-06 17:44:47小研科研成果库9
上个月逛国内消费电子展,随手试了试某创业公司展出的脑控智能轮椅。我坐在上面,啥都没碰,只盯着屏幕上的前进箭头,不到两秒轮椅就动了。当时鸡皮疙瘩都起来了。我们说人机交互这么多年,原来真的快要做到“心念一动,万物响应”了。

底层逻辑已经彻底翻转

人机交互技术发展百年时间轴图人机交互技术发展百年时间轴图 最早的人机交互,哪里算“交互”?本质就是人迁就机器。上世纪中期的计算机,要打穿孔卡,错一个孔,整批数据废掉,你得重新来一遍。后来鼠标和图形界面出来,普通人第一次不用记一堆命令行,点一下就完事,那时候才算是第一次真正把主动权交到人手里。再后来触摸屏、语音助手出来,我们习惯了戳玻璃、张嘴就能得到想要的结果。人机交互技术每一次换代,核心都是让机器越来越懂人,而不是让人去学机器的规则。 说实话,现在很多产品做交互全搞反了。为了凑创新卖点,加一堆花里胡哨的手势操作,侧边返回天天误触,上滑返回经常切出多任务,用着比老款的返回键还难受。这不叫进步,这叫折腾人。

最先落地的下一代交互,藏在我们每天开的车里

新能源汽车多模态人机交互实拍图新能源汽车多模态人机交互实拍图 很多人现在一提到新交互,就扯大模型聊天、元宇宙虚拟人,那些东西还在画饼呢。真正已经大规模落地、改变日常使用习惯的,就是多模态融合的车载人机交互。 去年中国汽车工程学会发的行业报告,2024年上市的新款乘用车里,车载语音交互的渗透率已经突破86%,近四成新车已经搭载了视线追踪交互功能。你跑高速,手不用离开方向盘,眼瞟一下中控的空调区域,说一句“调低两度”,系统直接就操作了,根本不用你伸手去摸屏幕,安全系数提升太多。 前年清华大学人机交互与体验设计实验室发了一篇顶会论文,测试结果说,这种基于视线+语音的多模态交互,比传统触摸交互的操作出错率低68%,平均操作时间缩短了42%。这数据就是硬实力。 之前坐过朋友2019款的新势力电动车,那语音交互真的绝了,开着音乐喊半天,它根本听不到,要么就是开着车突然莫名其妙跳出来响应,吓你一跳。现在的新技术解决了多少问题?声纹分清楚谁在说话,只响应主驾的指令,过滤后排的聊天噪音,上下文能接上,你说“调低一点”,它知道你说的是刚才聊的温度,不会瞎理解。这种进步,才是真的让人舒服。

被忽略的最大场景,是无障碍

被忽略的最大场景,是无障碍被忽略的最大场景,是无障碍 我之前一直觉得,人机交互技术就是给普通人提高效率,给玩家做新奇体验的。直到去年去残障康复中心做志愿者,才改变了这个想法。那里有个渐冻症的大叔,全身只有眼睛能动,之前用传统的眼动打字,一个字要盯好几秒,发一句“我饿了”要花半分钟。现在用上了新的脑机接口辅助交互,一分钟能打五十多个字,跟外地的女儿视频聊天,不用再让护工猜来猜去。这哪里是技术进步,这是给人重新打开了说话的门啊。 国内现在不少顶尖高校的人机交互实验室,都在往这个方向砸功夫。去年北京大学智能科学系的人机交互团队发了成果,基于柔性肌电传感器的假肢交互,用户能通过残存的肌肉信号控制假肢,精度能做到拿起一颗鸡蛋,捏住一块橡皮,甚至能玩拼图。我之前刷到过他们的实验视频,一个截肢的小伙子,用这个假肢自己夹菜吃,看完我半天没说话。 我们天天吐槽手机交互不好用的时候,根本想不到,有近千万国内的肢体、感官障碍者,连正常和机器打交道都做不到。人机交互技术对他们来说,不是卖点,不是黑科技噱头,是真的能改变生活的东西。 不过话说回来,现在这个方向的商业化落地还是太慢,大部分公司都盯着C端用户的钱袋子,愿意投钱做无障碍交互的太少。好在最近两年已经有变化了,不少大公司开始把无障碍交互写到产品的KPI里,资本也开始投相关的创业项目,至少是个好兆头。 交互的本质是什么?就是你感觉不到它的存在。你要做什么,机器自然懂,不用你费劲去学,费劲去适应。现在我们还在戳屏幕、喊语音,再过十年,你再看,人机交互技术会变成空气一样的存在——看不见,但是离不开,默默接住每个人的需求。这种改变,已经在慢慢发生了。