你每天都在用的人机交互技术,早就不是你想的那样了
你早上醒过来,摸过手机,指纹解锁,手指划一下打开外卖软件,戳两下选好早餐,下单,付款。整个过程不到十秒,你根本不会多想。但你有没有意识到——你每一个动作,都在用人机交互技术。
早期计算机打孔卡人机交互操作实拍
那时候普通人根本碰不到计算机,交互是专业人员的专属技能。后来鼠标发明,图形界面出来,直接颠覆了这个领域——你不用记一堆复杂的命令,看着屏幕点图标就行,普通人终于能用上电脑了。再后来苹果推出触摸屏手机,直接把交互搬到了你的手指底下,所有人都能上手,不用学。到现在呢?早就不是点按钮划屏幕的时代了。去年ACM顶会CHI放出来不少成果,我印象最深的一个,是通过衣服纤维里的微小传感器,采集你手臂肌肉的电信号,识别你悬空做的手势,连摄像头都不用,精度能到识别你捏的是一厘米还是两厘米的小物件。说实话我第一次看到的时候直接愣了。这不就是二十年前科幻片里才有的操作吗?现在真的做出来了。
大模型驱动自然语言人机交互界面演示图
不过话说回来,现在大半打着「大模型交互」旗号的产品,都是蹭热度的垃圾。上个月我陪朋友去车展,体验了某新势力的车载全语音交互,宣传说「不用动手全语音搞定」,结果我开着模拟驾驶说「把空调调低两度」,它给我打开了副驾车窗,还问我「要不要导航去最近的4S店」,尴尬得我脚趾抠出三层地下室。真创新哪有这么做的。现在真正有价值的科研方向,其实是个性化自适应人机交互。什么意思?就是系统能通过你日常的操作数据,摸透你的习惯,甚至能识别你的状态,随时调整交互方式。比如你开车的时候,它自动把所有功能按钮放大,只保留核心功能,所有次要操作都转成语音;你停车刷车机视频的时候,它自动给你切出细操作的触控栏,甚至你如果经常揉眼睛打哈欠,它知道你累了,直接把字体调大,把所有推送弹窗全关了。今年MIT CSAIL发了一篇相关的论文,测试下来,用户完成日常任务的效率提升了38%,出错率直接砍了一半还多。这种解决真实痛点的研究,才是真东西。
人机交互技术的下一个爆发点,早就不在手机里了
很多人说,现在交互不就那样?手机屏幕就这么大,还能玩出什么花?完全错了。现在最有潜力的方向,全是在手机之外。第一个就是脑机交互,别以为这还是十年前的概念,国内已经有科研团队做出了侵入式脑机接口的临床成果,高位截瘫的病人,戴上设备就能用意念打字,一分钟能打六十多个字,还能自己控制电动轮椅出门买东西。这哪里是技术进步,这是给一辈子困在床上的人,重新开了一扇接触世界的门啊。还有就是VR/AR里的触觉交互,以前你戴VR眼镜,只能看,碰什么都没感觉,现在已经有商用的原型产品,用超声波阵列在空中生成力反馈,你在VR里摸毛绒玩具,能感觉到绒毛蹭过手心的痒,摸玻璃能感觉到冷和光滑,我去年在乌镇世界互联网大会体验过一次,现在还记得那种惊讶的感觉——原来虚拟世界真的能摸到。
当然,现在很多方向还远没到普及的程度,一套触觉交互设备现在要十几万,脑机接口更是还在临床阶段,普通人用不上。但这些方向才是未来啊。说实话,人机交互这个领域,从诞生到现在,核心从来都没变过:就是让机器更懂人,让人不用花精力去学怎么用机器。你看,最早给专业人员做打孔卡,后来给普通人做图形界面做触控,现在给特殊人群做脑机做无障碍交互,所有的进步都是往这个方向走。很多人炫技做一堆花里胡哨的东西,用户用着反而更累,那都是歪路。
你今天出门开车,刷手机,买东西,用各种电子设备的时候,不妨停下来想想——那些你根本感觉不到「操作」的流畅体验,背后全是无数研究者攒了好几年的小心思。真的挺酷的,对吧?
从打孔卡到脑机接口,这个领域早就变天了
很多人对人机交互的印象还停留在「做手机APP界面」,错得离谱。从第一台通用计算机诞生开始,人机交互就是整个计算机领域最核心的方向之一。最早的交互是什么?打孔卡。你要算一道题,先在一沓卡片上按规则打好孔,输进机器,等几个小时出结果,打错一个孔,整沓卡直接废掉,重来。
早期计算机打孔卡人机交互操作实拍
那时候普通人根本碰不到计算机,交互是专业人员的专属技能。后来鼠标发明,图形界面出来,直接颠覆了这个领域——你不用记一堆复杂的命令,看着屏幕点图标就行,普通人终于能用上电脑了。再后来苹果推出触摸屏手机,直接把交互搬到了你的手指底下,所有人都能上手,不用学。到现在呢?早就不是点按钮划屏幕的时代了。去年ACM顶会CHI放出来不少成果,我印象最深的一个,是通过衣服纤维里的微小传感器,采集你手臂肌肉的电信号,识别你悬空做的手势,连摄像头都不用,精度能到识别你捏的是一厘米还是两厘米的小物件。说实话我第一次看到的时候直接愣了。这不就是二十年前科幻片里才有的操作吗?现在真的做出来了。
大模型带火的新交互,哪些是真创新哪些是蹭热度
大模型火了之后,最先改的就是人机交互的逻辑。以前你用任何工具,都得适应工具的规则:你要做PPT,得知道哪里插文本框,哪里改字体,哪里插图片,一步错就出问题。现在呢?你对着大模型说一句话「帮我做一个三分钟的行业分享PPT,要蓝白风格,加三个数据图表」,直接给你生成好,你改改就能用。整个交互逻辑从「人适应机器」变成了机器适应人,这是真真切切的变革。
大模型驱动自然语言人机交互界面演示图
不过话说回来,现在大半打着「大模型交互」旗号的产品,都是蹭热度的垃圾。上个月我陪朋友去车展,体验了某新势力的车载全语音交互,宣传说「不用动手全语音搞定」,结果我开着模拟驾驶说「把空调调低两度」,它给我打开了副驾车窗,还问我「要不要导航去最近的4S店」,尴尬得我脚趾抠出三层地下室。真创新哪有这么做的。现在真正有价值的科研方向,其实是个性化自适应人机交互。什么意思?就是系统能通过你日常的操作数据,摸透你的习惯,甚至能识别你的状态,随时调整交互方式。比如你开车的时候,它自动把所有功能按钮放大,只保留核心功能,所有次要操作都转成语音;你停车刷车机视频的时候,它自动给你切出细操作的触控栏,甚至你如果经常揉眼睛打哈欠,它知道你累了,直接把字体调大,把所有推送弹窗全关了。今年MIT CSAIL发了一篇相关的论文,测试下来,用户完成日常任务的效率提升了38%,出错率直接砍了一半还多。这种解决真实痛点的研究,才是真东西。
人机交互技术的下一个爆发点,早就不在手机里了
人机交互技术的下一个爆发点,早就不在手机里了
很多人说,现在交互不就那样?手机屏幕就这么大,还能玩出什么花?完全错了。现在最有潜力的方向,全是在手机之外。第一个就是脑机交互,别以为这还是十年前的概念,国内已经有科研团队做出了侵入式脑机接口的临床成果,高位截瘫的病人,戴上设备就能用意念打字,一分钟能打六十多个字,还能自己控制电动轮椅出门买东西。这哪里是技术进步,这是给一辈子困在床上的人,重新开了一扇接触世界的门啊。还有就是VR/AR里的触觉交互,以前你戴VR眼镜,只能看,碰什么都没感觉,现在已经有商用的原型产品,用超声波阵列在空中生成力反馈,你在VR里摸毛绒玩具,能感觉到绒毛蹭过手心的痒,摸玻璃能感觉到冷和光滑,我去年在乌镇世界互联网大会体验过一次,现在还记得那种惊讶的感觉——原来虚拟世界真的能摸到。
当然,现在很多方向还远没到普及的程度,一套触觉交互设备现在要十几万,脑机接口更是还在临床阶段,普通人用不上。但这些方向才是未来啊。说实话,人机交互这个领域,从诞生到现在,核心从来都没变过:就是让机器更懂人,让人不用花精力去学怎么用机器。你看,最早给专业人员做打孔卡,后来给普通人做图形界面做触控,现在给特殊人群做脑机做无障碍交互,所有的进步都是往这个方向走。很多人炫技做一堆花里胡哨的东西,用户用着反而更累,那都是歪路。
你今天出门开车,刷手机,买东西,用各种电子设备的时候,不妨停下来想想——那些你根本感觉不到「操作」的流畅体验,背后全是无数研究者攒了好几年的小心思。真的挺酷的,对吧?