脸书靠AI辨识恶意贴文特征,快速找出不当内容

脸书最近在2018年F8开发者大会上,介绍了平台如何透过AI技术,在用户通报恶意内容前,就能主动更快速找出不当的内容,且能够找出更多的不当贴文。
脸书一般是透过用户标注,或是技术主动找出恶意不当的内容,像是仇恨言论、包含色情或暴力的内容,这两项方法都很重要,但是随着科技的发展,脸书能够利用AI技术,包含机器学习、电脑视觉等技术,快速找到不当的内容。
现在,脸书可以更快速地找出恶意内容,而不是等待用户通报这些恶意内容,以有自杀倾向的贴文为例,快速辨识出用户表达了自杀的想法,可以马上与急救人员合作提供协助,目前已经成功阻止超过1,000个案例。
而主动的透过AI技术来检视贴文内容,可以在最短的时间内,删除不当的言论,例如,两周前脸书曾宣布2018年第一季已经主动删除了近200万则恐怖组织的贴文,其中,99%的贴文在尚未有用户通报前,系统就已经自动侦测并删除。
此外,脸书也提升了审核贴文团队的能力,团队需要有更多的专业知识背景,来了解特定的情况的案例,像是贴文是在说自己吸毒成瘾的状况,还是在鼓励别人吸毒。
脸书透过分析过去特定恶意内容的案例行为模式,来训练辨识模型主动找到其他类似的问题,针对裸露或是暴力的图片,脸书正透过电脑视觉技术来加强侦测。
而仇恨言论的部分,脸书已经开始主动检测贴文是否违法脸书政策,并经由审查团队检验,才不会误判不是仇恨言论的贴文,像是有些用户会描述自己遇到的仇恨言论来提高大家对该议题的重视。
另一方面,脸书也有许多假账户,脸书每天在假账户做出恶意行为之前,封锁了上百万个假账号,这样的封锁机制对于预防诈骗、假新闻、散布错误讯息和广告非常重要,最近脸书则是透过AI技术,来侦测账号和金融诈骗的关联性,大部分打击诈骗的工作,都是透过模式辨识来找出有问题的行为,若账户在短时间内连续发表贴文,大部分就是有问题的征兆。
除了上述的不当内容之外,大多数宣传恐怖攻击的贴文也会在用户未通报之前,就被自动删除。
脸书表示,即便有AI技术来协助侦测不当的内容,但是要有效地找出所有类型的不当内容,还需要更多的时间,和训练资料来辨识恶意贴文的模式、行为,像是较少语言的贴文,或是较少类型的不当贴文,就不容易有足够的训练资料来教导模型辨识,也因此,脸书来是鼓励用户看到不当的内容可以通报。
不过,脸书也正在尝试提升跨语言辨识模型的正确率,脸书AI研究院目前正在研究嵌入多种语言的技术Multi-lingual embeddings,或许能够解决语言的挑战。
