AWS深度学习相机首度在台亮相,AWS:今年将力推三大类AI服务

摄影/洪政伟
AWS一连三年在台举办技术高峰会AWS Summit Taipei,今年参加人数再创新高,超过4千人报名。前两年以上云、IoT和大数据服务为主打议题,今年则改主推AI,AWS开始大力在台推广自家相关AI服务,更首度在台展示深度学习相机DeepLens。AWS 方案架构部亚太区新兴技术主管Olivier Klein也上台介绍AWS在AI产品的布局,他解释,AWS的AI服务,可分为“每个人的AI”、“开发者的AI”和“资料科学家的AI”三大类。
在“每个人的AI”方面,AWS主打使用层面较广的应用程序,比如用来开发聊天机器人的Amazon Lex和自动语音辨识Amazon Transcribe,以及影像识别Rekognition等;在“开发者的AI”部分,则以AWS平台为主,像是能让开发人员快速建模及部署深度学习模型的Amazon SageMaker、深度学习相机DeepLens和群众外包平台Amazon Mechanical Turks等;而在“资料科学家的AI”方面,主要强调AWS支援的框架和界面,包括TensorFlow、Caffe2、Torch和Keras等。
除了讲解产品布局,Olivier Klein也现场示范了各种应用。在AWS语音识别部分,Olivier Klein就以自家的智慧语音助理Alexa为例。他表示,Alexa背后所用的技术,包括了自家的自然语言理解(NLU)技术Amazon Lex,来加强更自然的谈话体验。而Alexa除了会做一般语音助理会的事,比如回答简单的“你好吗?”问题,还能回应更复杂的指令,比如“我的脸书新贴文写了什么?”、“台湾在维基百科的解释是什么?”。Olivier Klein说,这是靠语音助理背后的知识库和Alexa技能工具包(ASK)来连结,让这款装置知道问题的关键字,然后从知识库中搜寻答案,进而回答问题。这个设计,让使用者可以根据自己的需求,来扩增Alexa的知识范围,像是客房服务用语、航务订票词汇,或是个人银行账号讯息等,来增加Alexa的技能。除此之外,Alexa还有声纹辨识的功能,能建立使用者声纹档案,以避免遭人误用来下单或执行不恰当的指令。
除了语音辨识,Olivier Klein也首度在台展示了Amazon为开发人员设计的深度学习相机:DeepLens。这款相机接收到的讯息,可直接传到AWS平台,执行深度学习和电脑视觉运算,并能以自家的Rekognition来分析画面,因此能够即时辨识物件,比如人脸、动物,或车辆等。不过,他没有透露,DeepLens正式在台推出的时间,但民众若有兴趣,可从Amazon网站订购。
此外,Olivier Klein也展示了基本的物体识别技术。他先把一台普通相机连接到自己的电脑,再执行以AWS训练好的脸部辨识模型,然后将相机对着会场民众,系统就能即时辨识画面中的物体(如下图)。不只简单的物体辨识,他展示的这款应用还包括肢体辨识和热成像辨识。
