广告

TikTok 的算法原理你知道多少?

时间:2020-09-11 11:58:55 阅读:
使用机器学习,TikTok的算法可以根据用户与其他用户集群、他们所喜欢内容的接近程度向用户提供视频。TikTok的逻辑旨在避免可能会让用户感到厌烦的冗余内容,比如看到具有相同音乐的多个视频或来自同一创建者的多个视频。
广告

流行短视频应用TikTok(抖音海外版)吸引了全球数亿用户持续沉迷其上,这在很大程度上要归功于算法。根据Sensor Tower的数据,在今年5月,抖音和TikTok全球下载量已经突破20亿次。仅在美国,TikTok就拥有1亿用户。基于这样庞大的用户数据,TikTok已经训练出了成熟的推荐模型。这些现实数据构成的数据集,实在是别的公司难以模仿的。

TikTok公司高管近日向美国媒体披露了有关这种“杀手级”算法的工作原理,包括如何利用机器学习最大限度地提高用户参与度,以及如何打破“信息茧房”的桎梏。

TikTok  算法揭秘

TikTok的算法可为用户推荐下一段要看的视频,它帮助该应用获得大量人气以及数百亿美元估值。迫于美国压力,字节跳动准备出售TikTok美国业务,而算法成为潜在交易的焦点之一。TikTok高管在与记者举行的电话会议上表示,他们正在披露有关算法和数据操作的细节,以消除有关该公司的各种谣言和误解。

TikTok高管为记者提供了一次虚拟之旅,参观其位于洛杉矶的新“透明中心”。该中心将为人们提供演示计算机模块的区域,这些模块展示TikTok的算法和数据操作是如何工作的。

TikTok的算法使用机器学习来确定用户最有可能参与的内容,并为他们提供更多内容,方法是找到相似的视频,或者有相似用户偏好的人喜欢的视频。当用户首次打开TikTok时,他们会看到8个热门视频,内容包括不同的趋势、音乐和主题。在此之后,算法将继续根据用户观看或参与的视频以及用户在做的事情,为用户提供8个更新的视频。

该算法根据视频信息(可能包括字幕、标签或声音等细节)识别与用户观看的视频相似的视频。它还考虑到用户设备和帐户设置,其中包括语言首选项、国家/地区设置和设备类型等数据。

当TikTok收集了足够多的用户数据,该应用就能够根据相似用户的喜好来绘制用户的偏好,并将他们分组到“集群”中。同时,它还根据类似的主题将视频分组,比如“篮球”或“兔子”等。

使用机器学习,TikTok的算法可以根据用户与其他用户集群、他们所喜欢内容的接近程度向用户提供视频。TikTok的逻辑旨在避免可能会让用户感到厌烦的冗余内容,比如看到具有相同音乐的多个视频或来自同一创建者的多个视频。

TikTok承认,之所以能够如此有效地锁定用户的偏好,意味着其算法可以产生“信息茧房”,强化用户现有的偏好,而不是向他们显示更多样化的内容,拓宽他们的视野,或者向他们提供不感兴趣的内容。

TikTok表示,他们正在研究“信息茧房”,包括它们能持续多长时间,以及用户如何遇到它们,以便在必要时更好地打破它们。由于“信息茧房”会强化阴谋论、恶作剧和其他错误信息,TikTok的产品和政策团队研究哪些账户和视频信息(主题、标签、字幕等)可能与错误信息有关。

链接到错误信息的视频或创作者会被发送到公司的全球内容审查员那里,这样TikTok就可以在上述内容在推荐页面上分发给用户之前对其进行管理。

TikTok还介绍了该公司在数据、隐私和安全方面的最新举措。该公司表示,它试图在事件发生之前对其平台上的事件进行分类和预防,方法是在问题蔓延之前检测问题的模式。

TikTok负责美国公共政策的副总裁迈克尔·贝克曼(Michael Beckerman)说:“尽管我们刚刚成立两年,但却有着长远目标。我们没有机会在互联网的黄金年代成长,当时科技公司不会做错任何事。我们成长在科技狂潮的时代,人们对平台、它们如何审核内容以及它们的算法如何工作都持怀疑态度。”

TikTok首席安全官罗兰·克劳蒂埃(Roland Cloutier)表示,计划在年底前在美国招聘100多名数据、安全和隐私专家。他还表示,该公司将在华盛顿特区建立一个监测、反应和调查反应中心,以积极检测和实时反应危急事件。

贝克曼表示,TikTok的透明度努力是为了将公司定位为硅谷的领导者。他说:“我们希望占据领导地位,更多地展示这款应用的工作原理。对我们来说,我们是新来者,我们想要这样做,因为我们没有什么可隐瞒的。我们与立法者交谈和会面的次数越多,他们对我们的产品就越了解,感觉越满意。”

据Business Insider报道,昆士兰科技大学的研究人员Bondy Valdovinos Kaye表示:我个人认为,如果没有这套算法,TikTok就不会成为TikTok。

而视频编辑应用Veed的创始人Sabba Keynejad则说,还没有看到哪家公司能在推荐系统上真正赶上TikTok的水平。不过,其实单纯从算法层面上来说,TikTok使用的技术基于一套业界标准的架构。不同的是,“每次点击都会揭示用户的喜好,在一定程度上,为TikTok提供更多有关用户喜好的有用信息”,而TikTok拥有规模庞大的用户基数。牛津大学互联网研究院的Nikita Aggarwal这样评价。并且,TikTok可以以YouTube这样的长视频平台无法想象的规模测试用户的兴趣。

TikTok可以每小时为用户提供上百个不超过一分钟的短视频。Amazon前产品负责人Eugene Wei认为:只需要几秒钟的反馈,就可以记录我对视频的感受。由于TikTok是全屏应用,它可以假定我所做的任何事情都在反映我对视频的看法。

此前,Sensor Tower移动策略师Craig Chapple也评论称:TikTok的持续崛起为它提供了一个更大的基础,不仅可以在短期内获得成功,还可以在长期内将现有和潜在的竞争对手挡在门外。

附TikTok的算法机制:

一、TikTok算法是什么

我们还是用通俗易懂的话来解说,TikTok的算法很像抖音。流量分配是去中心化的。

在Instagram上,如果没有粉丝,你发的内容就没人看和点赞。但是TikTok不一样,只要你发视频,不管好与坏,都有一定的浏览量。

行内叫做流量池,Tiktok的算法给会给每个视频100-1000。之后,tiktok会根据视频的表现,给第二波流量池1000+,以此类推。因此视频内容一定要够好够吸引人。

二、流量池

tiktok的流量池有不同等级,不同权重的账号有不同的流量池。抖音流量池评判标准:点赞数、评论数、转发数和完播率。

即便是刚刚申请的账号0粉丝,发任何视频也会有300左右的浏览量。无论你是不是红人,只要有优质内容,就有机会变成大号。心态一定要好,坚持发。

三、叠加推荐

当tiktok给我们第一波流量池,也相应地根据第一波流量池(0-1k播放量 )来判定我们的内容是否受欢迎。如果答案是yes,那么就会给第二波流量池(5k播放量),接下来就是第三波流量池(1w-10w流量)这里要遵循一个指标:

播放量(完播率)>点赞量>评论量>转发量(老外很喜欢点赞)

这里还要补充一个概念,行业内叫做“挖坟”,不知道大家有没有玩抖音,抖音有些以前发的视频不知道为什么就火了。这就是挖坟。其中真意,是之前的视频反馈不好,后来有个别用户很喜欢,tiktok就会认为你的视频很受用户喜欢。所以有些流量有些少的视频,不要删哈。

挖坟有好也有坏处,好处是你的视频反馈很好,粉丝也很多。但是有一条视频违规了,tiktok就会降权。

  • 流量池那里的数据是怎么计算的,怎么确定会给多少的播放量,有比较准确专业的数据支持吗?
本文为EET电子工程专辑 原创文章,禁止转载。请尊重知识产权,违者本司保留追究责任的权利。
  • Omdia :2024年生成式AI软件市场将增长124% 许多拥有大型语言模型(LLM)的供应商的收入运行率表明,2024 年的收入增长将达到三位数……
  • IDC首测8款最热门移动端大模型,3款获好评 本次报告的测评涵盖了市面上最热门的八个Chatbot App:kimi智能助手、豆包、海螺AI、天工、通义、文心一言、讯飞星火以及智谱清言(按照公司拼音首字母顺序排列)。
  • Imagination GPU为边缘智能提供高效率的加速 在“2024奕斯伟计算开发者伙伴大会”上,来自Imagination英国总部的专家发表了主题为《用RISC-V CPU + PowerVR GPU迎接边缘生成式AI的到来》的演讲。
  • 面向AI的下一代以太网技术 随着AI应用的广泛普及和数据流量的迅猛增长,传统以太网技术在延迟、带宽、拥塞控制和高性能可扩展方面天然局限,导致其难以应对AI网络的复杂需求。
  • 智能手机疲软,但超薄柔性玻璃出货量势头正猛 可折叠盖板玻璃必须符合以下所有标准:透明、可折叠、坚固、平整和轻薄,这些基本要素缺一不可。
  • 全球折叠屏手机快速增长,中国品牌压制三星 • 得益于西欧、关键亚洲市场和拉丁美洲市场的增长,以及中国品牌的持续领先,全球折叠屏手机出货量在2024年第二季度同比增长了48%。 • 荣耀凭借其在西欧特别强劲的表现,成为最大的贡献者,成为该地区排名第一的品牌。 • 摩托罗拉的Razr 40系列在北美和拉丁美洲表现良好,为其手机厂商的出货量贡献了三位数的同比增长。 • 我们预计,头部中国手机品牌厂商的不断增加将至少在短期内抑制三星Z6系列在第三季度的发布。
  • AI网络物理层底座: 大算力芯片先进封装技术 AI技术的发展极大地推动了对先进封装技术的需求,在高密度,高速度,高带宽这“三高”方面提出了严苛的要求。
  • 智能手表OLED面板超 60%中国制造 智能手表在新冠肺炎疫情后获得了越发广泛的关注,其功能包括语音、健康检查、运动和活动追踪、GPS、通信和个人数据监控。全球智能手表显示面板的出货量已从2022年的2.59亿片增长到2023年的3.51亿片。到 2024年,Omdia预测智能手表显示面板的出货量将达到3.59亿片,其中TFT LCD占63%,OLED占37%。
  • 无处不在的Arm软硬件生态赋能开发者AI创新 随着计算变得愈发复杂,计算效率的重要性更胜以往。
  • 荣耀拿下欧洲横折手机榜第一 既然可以保留几乎相同的旧款手机,或者以更低的价格购买旧款手机,为什么要购买最新款的智能手机呢?但变化已经到来,智能手机品牌厂商正带着其最前沿的创新技术重返欧洲市场……
广告
热门推荐
广告
广告
广告
EE直播间
在线研讨会
广告
广告
广告
向右滑动:上一篇 向左滑动:下一篇 我知道了