今年在MWC 2017期间与Google Assistant产品负责人Gummi Hafsteinsson访谈时,除了提及将使此项数位助理服务进驻到更多装置,并且提供相同使用体验,后续更加入可识别不同使用者声音等功能,在此次Google I/O 2017更宣布借由Google Lens服务让使用者能以视觉化形式与Google Assistant进行更多沟通。
Gummi Hafsteinsson表示,由于真实情境的“沟通”不仅只是声音,还包含其他形式。因此这次宣布推出的Google Lens服务便是相当好的例子,透过可视化影像让Google Assistant能与使用者产生更直觉的互动,例如透过投放至电视的图表即可了解未来一周的天气预报,或是将查询餐厅位置直接传递至手机屏幕上显示,进而透过Google Maps服务进行导航,或让使用者拨打电话订位。
而随着提供Actions on Assistant客制化功能,让开发者能借由此项功能增加更多Google Assistant服务应用功能,或是将本身打造服务、硬件设备与Google Asisstamt串接,让使用者能更方便地透过声音、影像达成与各类装置的“沟通”。
即便在不同装置仍有些为差异,但Google仍强调让所有的使用体验更为一致,例如iOS版Google Assistant虽然无法像Android平台能从系统底层唤醒,但配合按下麦克风按钮,一样能实现Android平台版本可自动承接上下句关连,进而达成可持续问答的使用效果,而不像多数数位助理完成回答一个问题之后便结束单次运作。
同时透过更多装置与人持续产生沟通互动,借着背后的深度学习机制将让系统更能了解各类使用需求,将能让相关运作反应越来越贴近使用者预期结果。
▲ Google Assistant产品负责人Gummi Hafsteinsson
不过,如同目前Google Assistant仍无法同时分析两种语言混合使用情况 (例如穿插中英词汇、语句),目前也无法同时满足同时进行两项要求以上事项,也就是无法要求搭载Google Assistant的调酒机器人在说个笑话之余,同时完成调酒工作。虽然对于人脑理解而言,同时进行两个动作并不花什么功夫,但对于系统而言却是相当复杂的演算,因此这也是Google目前努力方向。
由于要学习一个语言,并且理解相关词句所代表含意相当困难,因此目前Google Assistant依然必须透过持续学习才能熟悉一种语言。而虽然此次尚未宣布加入支援中文,仅说明对应法语、日语等语音互动模式,Google Assistant将如何理解尚未学习语言背后对应文化所产生差异,最主要便是仰赖研发团队来自全球各地,同时Google也有相当丰富的全球员工可作为参考,因此在大致上的互动逻辑判断并不会产生明显不同,透过持续学习之下更能让判断结果更为正确。
越来越多数位助理服务推行将有助机器“理解”人类
至于针对目前亚马逊、微软、苹果、三星等厂商均先后投入自有数位助理服务发展,Gummi Hafsteinsson认为越来越多厂商同样加入此类服务发展之下,将更有助于让机器更了解人类需求,进而产生全新的人机互动模式。
对于如何挑选目前各家厂商所推行的数位助理服务,Gummi Hafsteinsson的看法认为主要还是依照个人需求而定,毕竟在不同场合、使用模式之下,不同数位助理服务背后基于深度学习所产生反应互动,以及相关连结应用仍有不同,但可以预期的是所有厂商所推动的数位助理服务,无论是在Android、iOS或其他平台使用,都能提供相同或接近的使用体验。
你也许会想看以下内容:
- …
- Google…
- Google认为AR、VR发展本质相同…






























