广告

TikTok 的算法原理你知道多少?

时间:2020-09-11 11:58:55 阅读:
使用机器学习,TikTok的算法可以根据用户与其他用户集群、他们所喜欢内容的接近程度向用户提供视频。TikTok的逻辑旨在避免可能会让用户感到厌烦的冗余内容,比如看到具有相同音乐的多个视频或来自同一创建者的多个视频。
广告

流行短视频应用TikTok(抖音海外版)吸引了全球数亿用户持续沉迷其上,这在很大程度上要归功于算法。根据Sensor Tower的数据,在今年5月,抖音和TikTok全球下载量已经突破20亿次。仅在美国,TikTok就拥有1亿用户。基于这样庞大的用户数据,TikTok已经训练出了成熟的推荐模型。这些现实数据构成的数据集,实在是别的公司难以模仿的。

TikTok公司高管近日向美国媒体披露了有关这种“杀手级”算法的工作原理,包括如何利用机器学习最大限度地提高用户参与度,以及如何打破“信息茧房”的桎梏。

TikTok  算法揭秘

TikTok的算法可为用户推荐下一段要看的视频,它帮助该应用获得大量人气以及数百亿美元估值。迫于美国压力,字节跳动准备出售TikTok美国业务,而算法成为潜在交易的焦点之一。TikTok高管在与记者举行的电话会议上表示,他们正在披露有关算法和数据操作的细节,以消除有关该公司的各种谣言和误解。

TikTok高管为记者提供了一次虚拟之旅,参观其位于洛杉矶的新“透明中心”。该中心将为人们提供演示计算机模块的区域,这些模块展示TikTok的算法和数据操作是如何工作的。

TikTok的算法使用机器学习来确定用户最有可能参与的内容,并为他们提供更多内容,方法是找到相似的视频,或者有相似用户偏好的人喜欢的视频。当用户首次打开TikTok时,他们会看到8个热门视频,内容包括不同的趋势、音乐和主题。在此之后,算法将继续根据用户观看或参与的视频以及用户在做的事情,为用户提供8个更新的视频。

该算法根据视频信息(可能包括字幕、标签或声音等细节)识别与用户观看的视频相似的视频。它还考虑到用户设备和帐户设置,其中包括语言首选项、国家/地区设置和设备类型等数据。

当TikTok收集了足够多的用户数据,该应用就能够根据相似用户的喜好来绘制用户的偏好,并将他们分组到“集群”中。同时,它还根据类似的主题将视频分组,比如“篮球”或“兔子”等。

使用机器学习,TikTok的算法可以根据用户与其他用户集群、他们所喜欢内容的接近程度向用户提供视频。TikTok的逻辑旨在避免可能会让用户感到厌烦的冗余内容,比如看到具有相同音乐的多个视频或来自同一创建者的多个视频。

TikTok承认,之所以能够如此有效地锁定用户的偏好,意味着其算法可以产生“信息茧房”,强化用户现有的偏好,而不是向他们显示更多样化的内容,拓宽他们的视野,或者向他们提供不感兴趣的内容。

TikTok表示,他们正在研究“信息茧房”,包括它们能持续多长时间,以及用户如何遇到它们,以便在必要时更好地打破它们。由于“信息茧房”会强化阴谋论、恶作剧和其他错误信息,TikTok的产品和政策团队研究哪些账户和视频信息(主题、标签、字幕等)可能与错误信息有关。

链接到错误信息的视频或创作者会被发送到公司的全球内容审查员那里,这样TikTok就可以在上述内容在推荐页面上分发给用户之前对其进行管理。

TikTok还介绍了该公司在数据、隐私和安全方面的最新举措。该公司表示,它试图在事件发生之前对其平台上的事件进行分类和预防,方法是在问题蔓延之前检测问题的模式。

TikTok负责美国公共政策的副总裁迈克尔·贝克曼(Michael Beckerman)说:“尽管我们刚刚成立两年,但却有着长远目标。我们没有机会在互联网的黄金年代成长,当时科技公司不会做错任何事。我们成长在科技狂潮的时代,人们对平台、它们如何审核内容以及它们的算法如何工作都持怀疑态度。”

TikTok首席安全官罗兰·克劳蒂埃(Roland Cloutier)表示,计划在年底前在美国招聘100多名数据、安全和隐私专家。他还表示,该公司将在华盛顿特区建立一个监测、反应和调查反应中心,以积极检测和实时反应危急事件。

贝克曼表示,TikTok的透明度努力是为了将公司定位为硅谷的领导者。他说:“我们希望占据领导地位,更多地展示这款应用的工作原理。对我们来说,我们是新来者,我们想要这样做,因为我们没有什么可隐瞒的。我们与立法者交谈和会面的次数越多,他们对我们的产品就越了解,感觉越满意。”

据Business Insider报道,昆士兰科技大学的研究人员Bondy Valdovinos Kaye表示:我个人认为,如果没有这套算法,TikTok就不会成为TikTok。

而视频编辑应用Veed的创始人Sabba Keynejad则说,还没有看到哪家公司能在推荐系统上真正赶上TikTok的水平。不过,其实单纯从算法层面上来说,TikTok使用的技术基于一套业界标准的架构。不同的是,“每次点击都会揭示用户的喜好,在一定程度上,为TikTok提供更多有关用户喜好的有用信息”,而TikTok拥有规模庞大的用户基数。牛津大学互联网研究院的Nikita Aggarwal这样评价。并且,TikTok可以以YouTube这样的长视频平台无法想象的规模测试用户的兴趣。

TikTok可以每小时为用户提供上百个不超过一分钟的短视频。Amazon前产品负责人Eugene Wei认为:只需要几秒钟的反馈,就可以记录我对视频的感受。由于TikTok是全屏应用,它可以假定我所做的任何事情都在反映我对视频的看法。

此前,Sensor Tower移动策略师Craig Chapple也评论称:TikTok的持续崛起为它提供了一个更大的基础,不仅可以在短期内获得成功,还可以在长期内将现有和潜在的竞争对手挡在门外。

附TikTok的算法机制:

一、TikTok算法是什么

我们还是用通俗易懂的话来解说,TikTok的算法很像抖音。流量分配是去中心化的。

在Instagram上,如果没有粉丝,你发的内容就没人看和点赞。但是TikTok不一样,只要你发视频,不管好与坏,都有一定的浏览量。

行内叫做流量池,Tiktok的算法给会给每个视频100-1000。之后,tiktok会根据视频的表现,给第二波流量池1000+,以此类推。因此视频内容一定要够好够吸引人。

二、流量池

tiktok的流量池有不同等级,不同权重的账号有不同的流量池。抖音流量池评判标准:点赞数、评论数、转发数和完播率。

即便是刚刚申请的账号0粉丝,发任何视频也会有300左右的浏览量。无论你是不是红人,只要有优质内容,就有机会变成大号。心态一定要好,坚持发。

三、叠加推荐

当tiktok给我们第一波流量池,也相应地根据第一波流量池(0-1k播放量 )来判定我们的内容是否受欢迎。如果答案是yes,那么就会给第二波流量池(5k播放量),接下来就是第三波流量池(1w-10w流量)这里要遵循一个指标:

播放量(完播率)>点赞量>评论量>转发量(老外很喜欢点赞)

这里还要补充一个概念,行业内叫做“挖坟”,不知道大家有没有玩抖音,抖音有些以前发的视频不知道为什么就火了。这就是挖坟。其中真意,是之前的视频反馈不好,后来有个别用户很喜欢,tiktok就会认为你的视频很受用户喜欢。所以有些流量有些少的视频,不要删哈。

挖坟有好也有坏处,好处是你的视频反馈很好,粉丝也很多。但是有一条视频违规了,tiktok就会降权。

  • 流量池那里的数据是怎么计算的,怎么确定会给多少的播放量,有比较准确专业的数据支持吗?
本文为EET电子工程专辑 原创文章,禁止转载。请尊重知识产权,违者本司保留追究责任的权利。
  • 中国成为最大腕戴设备市场,引领全球增长 腕戴设备市场包含智能手表和手环产品。其中,智能手表市场在2024年前三季度全球出货量1.1亿台,同比下降3.8%;而中国智能手表市场出货量3,286万台,同比增长……
  • 截止2030年,全球蜂窝物联网连接收入将超过 260 亿美元 • 2023 年,全球蜂窝物联网连接数激增 24%,超过 33 亿,到 2030 年将突破 62 亿。 • 尽管中国在 2023 年以 23 亿的连接数规模占据全球蜂窝物联网连接总数的 70%,但其在全球连接收入中的份额仅为 36%。 • 到 2030 年,联网汽车、智能表计和智能零售这三大应用预计将合计占蜂窝物联网应用总市场份额的 60% 以上。 • 到 2030 年,5G 连接将在全球范围内超过 NB-IoT 连接,占物联网连接总收入的近 50%。
  • 为什么翻新机的价格在上涨? • 目前,iPhone在翻新市场中是最热门的商品,并将长期主导着翻新机的平均销售价格。 • 全球翻新机市场持续向高端化发展,其平均销售价格(ASP)现已超过新手机。 • 新兴市场是增长的最大驱动力,消费者对高端旗舰产品有着迫切需求。 • 由于市场固化和供应链的一些问题限制推高中国、东南亚和非洲等大市场的价格。 • 2024年,这些翻新机平均销售价格将首次超过新手机。
  • 2024三季度全球扫地机器人市场出货增长持续,卷势不减 从全球厂商竞争来看,三季度凭借多个新品发布,石头科技市场份额提升至16.4%,连续两季度排名全球第一……
  • AMOLED行业核心模具,精密金属掩膜版国产技术攻克核心瓶颈 AMOLED行业的关键模具FMM及Invar在市场中属于极其细分而品质又要求极高的赛道,传统企业打法在这两个产品上都难以适用。唯有对上下游有深度了解,并能够将产业链技术链条打通,才能够将近似于黑箱中的FMM及其原材料Invar长期受限的困局打破。
  • IDC:2024前三季度中国安全硬件市场规模同比下降2.9% IDC定义下的网络安全硬件市场分别由统一威胁管理 (UTM)、基于UTM平台的防火墙 (UTM Firewall) 、安全内容管理(SCM)、入侵检测与防御 (IDP)、虚拟专用网(VPN)和传统防火墙 (Traditional Firewall) 构成。
  • 预计1Q25 NAND Flash价格将出现超10%下滑 2025年第一季NAND Flash供货商将面临库存持续上升,订单需求下降等挑战,平均合约价恐季减10%至15%。
  • 山东大学团队在高精度存算芯片领域取得新进展 本研究通过设计闪存存算一体架构,有效提升了计算效率和精度,为解决复杂计算任务提供了重要技术支撑。
  • 加速资源整合将是本田与日产合并后的首要任务 日本两大全球汽车集团本田与日产于2024年12月23日宣布启动合并谈判,目标在2025年6月达成协议,三菱汽车也有望加入。若三家车厂顺利合并,当务之急将是整合各自的资源以节省开支,利用规模化生产降低成本,以及加快电动车相关计划......
  • 2024过去了,细数中国工业经济这一年 这一年的成绩单足够亮眼,但来之不易。
广告
热门推荐
广告
广告
广告
EE直播间
在线研讨会
广告
广告
广告
向右滑动:上一篇 向左滑动:下一篇 我知道了