脸书又搞砸了。就像矫枉过正。这次它删错了帖子。
3月17日,许多脸书用户发现他们从媒体转发的关于新冠肺炎的文章被删除了,页面显示这些链接违反了社区的垃圾邮件规则。

随着全球新冠肺炎疫情越来越严重,围绕疫情的假新闻也越来越多。如何识别假新闻和删帖,成为最近社交媒体最关心的问题。但上述被删除的文章均为官方合法媒体网站,包括《大西洋月刊》、《今日美国》、BuzzFeed等美国老牌或新兴媒体。
换句话说,脸书删除了作为假新闻的真实新闻。
疫情期间,社交媒体上的假新闻越来越多,如何鉴别成了问题|视觉中国
矛头很快指向了脸书的人工智能审计系统。由于疫情,脸书在3月16日暂停了公司所有内容审查人员的工作,内容审查工作交给了平台上的“机器人”。脸书声称:“由于可供审查的工作人员越来越少,我们将继续优先考虑那些迫在眉睫的内容,并在其他领域增加主动检测,以删除非法内容。」
人们自然怀疑人工智能误删了正规新闻。但随后,脸书副总裁盖伊·罗森(Guy Rosen)表示,这是反垃圾邮件系统中的一个错误,与公司内容审查团队所做的任何调整无关。
虽然整个事情出了问题,但是反映了人们对技术的不信任。最近,谷歌还警告说,视频平台YouTube上误删的视频数量可能会大大增加,因为在新冠肺炎疫情期间,该公司将更多地依赖人工智能而不是人类来审查视频。
即使在大科技公司的口中,AI也一直在进步,似乎可以承担大量的手工工作。但是,内容审核并不能完全由AI来处理。相反,近几年的趋势是大公司扩大了人工审计的规模。为什么人工智能发展这么多年,内容审核却需要更多的人工?这背后,大公司都经历了什么?
内容爆炸,AI承担了审核的责任。
对互联网来说不是违法的地方。为了解决网络上的淫秽、色情、暴力、血腥等违法内容,很多平台都会设置内容审查制度。
有必要提一下互联网公司,如谷歌、脸书、推特等。近年来大大加强了内容审查。原因可以概括为“流量的变化”。
一方面,平台的用户增长到了一个可怕的量级。就脸书而言,2019年第四季度,脸书的月活达到25亿,这还只是一个app,还不算脸书的Messenger、Instagram和WhatsApp应用。
另一方面,近年来内容形式变得越来越复杂。从文字,到图片,再到现在的视频和流媒体,互联网上的数据量疯狂增长,每天都有更多的用户在生产更多的内容。
随着信息、内容和用户的爆炸式增长,科技巨头不仅可能开创一个新时代,也可能打开潘多拉魔盒。在这个过程中,控制内容尤为重要。
以脸书为例。过去,脸书对内容的管控相对松懈,虚假新闻、标题党甚至恐怖言论频频出现,审核团队数量少得惊人。据悉,2012年脸书拥有8亿多用户时,审计团队只有50人左右。
在过去的几年里,人工智能已经成为脸书在内容评论|视觉中国中所希望的技术
人工智能兴起后,许多互联网巨头首次将技术应用于自己的业务,包括脸书。自2017年以来,脸书一直试图用人工智能来解决内容审查的问题。当时可以使用AI图像识别工具搜索照片,还宣布推出可以识别试图自杀或自残的用户的系统。
然而当时的人工智能技术还不够成熟。例如,在理解上下文方面,脸书的人工智能系统不够智能。而且AI当时只能作为辅助判断,并不能真正决策。扎克伯格在当时的公开信中提到,这个系统可以标记出可疑的内容,以便团队再次审查。
如今,人工智能在脸书的内容审查方面取得了巨大进步。据脸书首席技术官迈克·施罗夫(mike schroepfer)在接受采访时表示,脸书已经能够自动删除社交网络中96%的裸体内容。仇恨言论的问题更棘手。人工智能系统可以识别65%包含仇恨言论的帖子。
对于图片和视频,人工智能介入审核是非常有效的,因为计算机视觉识别技术已经比较成熟。经过一定时间的训练,机器可以识别敏感内容,比如裸露、枪支等。同样,脸书已经演示了AI对图片和视频的识别,基本上不会出现错误。
脸书人工智能技术在图像识别中的应用|视觉中国
然而,随着人工智能技术的快速发展,似乎可以代替人做更多的事情,脸书做出了一个出人意料的举动:扩大人工审计团队。
据不完全统计,2017年以来,脸书几乎每年都要招聘上千名内容审核人员,2020年这一数字已增至1万多人。他们要做的事情听起来也很简单:根据脸书的用户内容政策审查并删除有害内容。
是什么让脸书对科技“失去信心”?

出现盲点
2019年3月15日,28岁的布伦顿·塔兰特持枪闯入新西兰克赖斯特彻奇的两座清真寺,向正在参加主麻日活动的人群开枪,造成50人死亡。这个消息在全世界广为传播,因为凶手在脸书直播上直播了从准备武器到杀人的全过程。
凶案直播持续了17分钟才被脸书删除,但17分钟足以让一个直播广泛传播,更不用说保存下来的视频在平台上传播了。尽管脸书表示“迅速采取行动删除了内容”,但一些用户表示,在删除视频几个小时后,他们仍然可以看到这些内容。
在过去的两年里,同样的情况已经发生了几次,脸书的反应往往不够及时,导致糟糕的情况时有发生。而这就涉及到了图片和视频之外的人工智能“盲点”——直播。
直播成为脸书内容评论的难点之一|视觉中国
不同于固有的图像和视频识别,直播对审核的要求非常高。除了实时图像识别的难度,人在直播中的一举一动都无法预测,这是目前无论是人还是机器都无法做到的。没有人知道,播报员下一秒就会在镜头前拍摄。
斯科波夫还提到,人工智能未能将新西兰枪击事件的直播识别为危险内容,因为“它与之前上传到脸书的视频不同。这个视频以第一人称视角展示了这个过程,就像一个电脑游戏。」
因此,在2017年发生一起现场谋杀案后,脸书增加了3000名人类审计员,专门审查暴力现场视频。对于一个庞大的平台来说,人工智能技术还远没有完全取代人类,甚至是部分取代。内容审核远比人们想象的困难。
与人工智能的合作
我们的环境非常不同。世界上不同地区的政治文化背景不同,每天都可能有变化。AI处理不了这么复杂的动态。
那么,将同样的逻辑应用于人工审计是否可行呢?这涉及到平台的一套审计标准。
2018年,脸书首次公布了详细的内容审查标准,即社区代码。经过几个版本的调整,该标准分为六个部分:暴力和犯罪行为,安全,不良内容,完整性和真实性,尊重知识产权和内容相关的应用程序,这些部分定义了哪些内容可能被删除。
但问题是,并不是所有的内容都是非黑即白的,不可能所有的审计人员都有明确的标准,做出一致的决策。
在内容审核上,人工智能技术和人的思维逻辑不太一样|视觉中国
技术的逻辑和人的思维逻辑不一样。说到底,深度学习技术只是基于已有的数据进行训练,从而呈现出一种数据模型,与人类的主动思维完全不同。因此,正如脸书人工智能副总裁杰罗姆·佩森蒂(Jerome Pesenti)所说,“AI和人类智能之间的差距非常大。它会传播人类的偏见,不好解释,缺乏常识。它停留在模式匹配的层面而不是强语义理解”。所以如果AI在内容审核的判断上出现偏差,没人敢为此负责。
如上所述,AI在理解仇恨言论方面无法达到像识别图片和视频那样高的准确率。原因在于内容本身。不同的内容表达有不同的含义,这可能取决于上下文。这可能只是讽刺,但不是仇恨言论的高潮...因为很难被定义,AI对这个内容的审核有局限性。
综上所述,人工智能代替不了人类的问题是技术在理解语言和行为预测上有一些困难,这些问题即使是人类也无法马上回答。利用AI将疑似有害内容送人工审核进行二次判断,从安全性和成本角度来看是最好的解决方案。
加州大学洛杉矶分校信息研究教授莎拉·t·罗伯茨(Sarah T. Roberts)长期以来一直在研究社交媒体的内容审计。最近她看到了社交媒体的审核方式从人工审核向训练机器审核演变的趋势,让人们可以对机器审核的内容进行决策。当然,在整个审计过程中,“人”始终没有走出这个闭环。“我们将拥有的是‘混合动力’。萨拉特。罗伯茨说。
内容审计的意义
不仅仅是脸书,在时代的巨变下,科技巨头公司掌握了大量的信息和内容,一举颠覆了“媒体”的概念。这种改变世界的影响,是科技公司的创始人刚创业时始料未及的。
然而,在改变世界之后,留给他们的问题是,如何不滑入“黑暗面”,甚至让平台变得更加光明。或许这就是所有巨头在内容审核上投入大量金钱和精力的意义。
平台的内容控制和商业利益一直是矛盾的,科技公司需要做的就是在这两者之间找到一个平衡点。放弃短期的商业利益,克制自己的边界,可能是交换来的巨大社会影响力,这也是科技巨头必须面对的巨大挑战。

如果把互联网巨头比作一艘快速向前滚动的巨轮,算法就是其中的关键部分之一。如果零件稍微偏离,巨轮的轨迹很可能会发生巨大的变化。而怎么偏,偏多少部分,师傅都能算出来。
因此,对于大公司来说,如何给自己引以为傲的“技术”和“商业”标签增加社会影响力和价值,是一个更为迫切的问题。毕竟科技没有善恶之分。善或恶来自于科技的使用者。
编辑:宋德生
图片来源:视觉中国
本文首发于极客公园。转载请联系极客君微信geekparker或zhuanzai@geekpark.net。


