流行短视频应用TikTok(抖音海外版)吸引了全球数亿用户持续沉迷其上,这在很大程度上要归功于算法。该公司高管近日披露了有关这种“杀手级”算法的工作原理,包括如何利用机器学习最大限度地提高用户参与度,以及如何打破“信息茧房”的桎梏。
TikTok的算法可为用户推荐下一段要看的视频,它帮助该应用获得大量人气以及数百亿美元估值。迫于美国压力,字节跳动准备出售TikTok美国业务,而算法成为潜在交易的焦点之一。TikTok高管在与记者举行的电话会议上表示,他们正在披露有关算法和数据操作的细节,以消除有关该公司的各种谣言和误解。
TikTok负责美国公共政策的副总裁迈克尔·贝克曼(Michael Beckerman)说:“尽管我们刚刚成立两年,但却有着长远目标。我们没有机会在互联网的黄金年代成长,当时科技公司不会做错任何事。我们成长在科技狂潮的时代,人们对平台、它们如何审核内容以及它们的算法如何工作都持怀疑态度。”
TikTok高管为记者提供了一次虚拟之旅,参观其位于洛杉矶的新“透明中心”。该中心将为人们提供演示计算机模块的区域,这些模块展示TikTok的算法和数据操作是如何工作的。
TikTok的算法使用机器学习来确定用户最有可能参与的内容,并为他们提供更多内容,方法是找到相似的视频,或者有相似用户偏好的人喜欢的视频。
当用户首次打开TikTok时,他们会看到8个热门视频,内容包括不同的趋势、音乐和主题。在此之后,算法将继续根据用户观看或参与的视频以及用户在做的事情,为用户提供8个更新的视频。
该算法根据视频信息(可能包括字幕、标签或声音等细节)识别与用户观看的视频相似的视频。它还考虑到用户设备和帐户设置,其中包括语言首选项、国家/地区设置和设备类型等数据。
当TikTok收集了足够多的用户数据,该应用就能够根据相似用户的喜好来绘制用户的偏好,并将他们分组到“集群”中。同时,它还根据类似的主题将视频分组,比如“篮球”或“兔子”等。
使用机器学习,TikTok的算法可以根据用户与其他用户集群、他们所喜欢内容的接近程度向用户提供视频。TikTok的逻辑旨在避免可能会让用户感到厌烦的冗余内容,比如看到具有相同音乐的多个视频或来自同一创建者的多个视频。
TikTok承认,之所以能够如此有效地锁定用户的偏好,意味着其算法可以产生“信息茧房”,强化用户现有的偏好,而不是向他们显示更多样化的内容,拓宽他们的视野,或者向他们提供不感兴趣的内容。
TikTok表示,他们正在研究“信息茧房”,包括它们能持续多长时间,以及用户如何遇到它们,以便在必要时更好地打破它们。由于“信息茧房”会强化阴谋论、恶作剧和其他错误信息,TikTok的产品和政策团队研究哪些账户和视频信息(主题、标签、字幕等)可能与错误信息有关。
链接到错误信息的视频或创作者会被发送到公司的全球内容审查员那里,这样TikTok就可以在上述内容在推荐页面上分发给用户之前对其进行管理。
TikTok还介绍了该公司在数据、隐私和安全方面的最新举措。该公司表示,它试图在事件发生之前对其平台上的事件进行分类和预防,方法是在问题蔓延之前检测问题的模式。
TikTok首席安全官罗兰·克劳蒂埃(Roland Cloutier)表示,计划在年底前在美国招聘100多名数据、安全和隐私专家。他还表示,该公司将在华盛顿特区建立一个监测、反应和调查反应中心,以积极检测和实时反应危急事件。
贝克曼表示,TikTok的透明度努力是为了将公司定位为硅谷的领导者。他说:“我们希望占据领导地位,更多地展示这款应用的工作原理。对我们来说,我们是新来者,我们想要这样做,因为我们没有什么可隐瞒的。我们与立法者交谈和会面的次数越多,他们对我们的产品就越了解,感觉越满意。”