AlphaFold 2再发350000种蛋白质结构预测结果,解锁98.5%人类蛋白质组!

OpenCV学堂 2021-07-23 21:29


点击上方↑↑↑OpenCV学堂”关注我

来源:公众号 新智元 授权



【导读】蛋白质结构预测「资深玩家」DeepMind又发大招,时隔一周再次在nautre发文:AlphaFold已经预测出了350000种蛋白质结构,涵盖了几乎所有人类蛋白质组以及20种生物的蛋白质,现可通过公布的数据库查看各个蛋白质的3D结构。


上周在科学界发生了十分有戏剧性的一幕:两大科学顶刊Science和nature同时发文,两支研究团队都表示可以通过AI模型预测蛋白质和一些分子复合物的精确3D原子结构。

 

来自华盛顿大学的科研团队在Science上公布了RoseTTAFold,宣称这个模型的性能与AlphaFold 2相当。

 

并且其端到端版本在RTX2080上生成少于400个残基的蛋白质的骨干坐标仅需10分钟

 

RoseTTAFold蛋白质预测工具的论文


这显然让谷歌DeepMind团队有些措手不及,匆匆忙忙选择在nature上开源了AlphaFold 2的技术细节。

 

不过今天故事似乎要反转:DeepMind团队在nature上再接再厉,公布了他们已经使用AlphaFold工具预测的来自人类和20种其他生物共350000种蛋白质的结构,例如大肠杆菌、酵母菌和果蝇等等。

 

论文链接:https://www.nature.com/articles/s41586-021-03828-1

 

目前他们已经复现了44%的人类蛋白质结构,覆盖了人类基因组编码的所有氨基酸结构位置的近60%。

 

不仅如此,这个团队将在未来的几个月里,通过计算预测目前UniRef目录中所有科学界已知的,经过测序的1亿个蛋白质分子结构

 

而AlphaFold与EMBL-EBI(欧洲分子生物学实验室)合作推出了蛋白质结构数据库(链接:https://alphafold.ebi.ac.uk/),科研人员只要输入蛋白质名称或编号,就可以迅速获得蛋白质的3D结构图像。


模型好不好,还得看疗效。看来AlphaFold这一次靠「钞能力」赢了。

 

AlphaFold新进展


昨日,DeepMind在nature上刊登的文章,描述了AlphaFold对人类蛋白质组的结构预测,覆盖了98.5%的所有人类蛋白质组,还对20种其它生物蛋白质的结构进行了预测。

 

这20种其它生物包括大肠杆菌、酵母菌、果蝇等,它们都是生物研究的重点。

 

果蝇蛋白质3D结构示意图


在论文中,作者表示,AlphaFold能够对人类蛋白质组35.7%氨基酸结构位置进行预测,且有很高的置信度,是实验方法覆盖的结构数量的两倍。

 

在单个蛋白质水平上,AlphaFold能够对43.8%的蛋白中,至少四分之三的氨基酸序列给出了可信预测。

 

 

在单个蛋白质的介绍中,数据库列出了蛋白质的基本信息,包括蛋白质名称、基因、来源生物、生物功能等。

 

 

以T细胞免疫调节蛋白同源物为例,这个蛋白质可以通过免疫调节保护寄生虫免受宿主免疫系统的攻击。

 

恶性疟原虫T细胞免疫调节蛋白同源物结构图

 

如上图所示,DeepMind在数据库公布的蛋白质结构预测模型中,不同的颜色表示不同的预测可信度

 

残基置信度分数(pLDDT)范围在0-100,数值大于90指信度非常高,表示为蓝色;数值为70-90表示为浅蓝色;数值为50-70表示为黄色;橙色部分表示信度非常低,数值小于50,有可能是孤立的非结构化区域。

 

 

除了公布蛋白质基本信息及模型结构外,网站还公布了蛋白质结构的预测对齐误差,后续还会推出蛋白质序列特征功能。

 

蛋白质结构模型的预测对齐误差

 

AlphaFold 2预测出了约20000种人类基因组蛋白质,加上20种其它生物的蛋白质组的结构预测,总计公布了超过350000种蛋白质结构预测模型。

 

「AlphaFold确定了覆盖几乎整个人类蛋白质组(98.5%的所有人类蛋白,即Uniprot里所有2700aa以下的蛋白)的蛋白质的结构。」

 

DeepMind表示,接下来的几个月将计划扩大蛋白质模型列表,以涵盖所有编目的蛋白质,共计大约1亿个分子。

 

AlphaFold为近44%的人类蛋白质预测了结构,涵盖了人类基因组中60%的氨基酸结构位置预测。

 

AlphaFold确定了许多其他人类蛋白质是「无序的」,也就是说,蛋白质的形状不采用单一结构。

 

当这种无序的蛋白质与另一蛋白质结合时,最终可能会确定出一种结构。

 

当然,这些蛋白质也可能会有多种结构。

 

 

蛋白质结构预测:50年的难题

 

蛋白质的 3D 结构在很大程度上决定了它的功能,通过研究蛋白质的3D结构,生物学家不仅可以更加快速地研发出针对各类疾病的药物,甚至能够揭开生命之谜。

 

弄清楚蛋白质折叠成什么形状被称为“蛋白质折叠问题”,在过去的50年里一直是生物学的一个巨大挑战。

 

通过结构测定是一个有效但非常费力的方法,它比基因组测定难度大得多。

 

按照传统的实验步骤,从基因序列到相应的蛋白质结构测定之间还要经过基因表达、蛋白质的提取和纯化、结晶、X射线衍射分析等步骤。由于蛋白质结构和性质的多样性,这些步骤大多没有固定的规律可循。

 

并且试验需要反复进行多次,每个结构的测定可能都需要数年的工作,并且动用价值数百万元的设备。

 

 

在1972年诺贝尔化学奖的获奖感言中,克里斯蒂安·安芬森( Christian Anfinsen  ) 提出了一个著名假设:理论上,蛋白质的氨基酸序列应该完全决定其结构。

 

 

但是从理论上分析,蛋白质在形成之前,可以折叠出天文数字的3D结构。


 

1969年,赛勒斯·莱文塔尔 (Cyrus Levinthal) 指出,通过蛮力计算列举出典型蛋白质的所有可能构型所需的时间比已知宇宙的年龄还要长。

 

 

他预测,一个典型的蛋白质可能有10的300次方种折叠形式。

 

如今DeepMind的团队用AI解开了这道世纪难题。


经过训练的深度神经网络可以根据蛋白质的基因序列预测蛋白质的特性。主要判断依据是氨基酸对之间的距离和连接这些氨基酸的化学键之间的角度。


通过已知信息,可以推断出蛋白质折叠之后的角度和距离信息,从而推断出整个蛋白质的结构。


AlphaFold数据库的建立,把生物科学家们从研究蛋白质时最费时费力的结构测定工作中解脱了出来,从而可以专心转向研究的核心部分。

 

「我们原来花费数个月甚至数年时间才完成的事情,AlphaFold在一个周末就能完成」,朴茨茅斯大学结构生物学教授兼酶创新中心 (CEI) 中心主任感慨道。

 

在AlphaFold的帮助下,朴茨茅斯大学酶创新中心正在设计一种酶,来加速降解一次性塑料。

 

科罗拉多大学博尔德分校的一个团队在使用AlphaFold来预测研究抗生素耐药性的前景。

 

更多的可能性还在不断被发掘。


业内不只有AlphaFold


除了AlphaFold和RoseTTAFold两大工具以外,商业上也有与蛋白质预测相关的消息。

 

成立于2011年,专注于在大肠杆菌中制造蛋白质的公司Absci在周四上市。


 

今年1月,Absci收购了Denovium,一家使用深度学习人工智能对蛋白质进行分类和预测的公司,目前已经接受了1亿种蛋白质的训练。

 

Absci在6月还收购了Totient,一家分析免疫系统对某些疾病的反应的生物技术公司。

 

这样一来,Absci就具备了蛋白质制造、评估和筛选能力,完善了从蛋白质制造和测试到人工智能支持的药物开发。

 

随着人工智能的不断发展,人工智能有可能彻底改变21世纪的科学工作方式。

 

人工智能对蛋白质大规模的准确结构预测,将成为推动生物医学界发展的重要工具,从蛋白质的结构解决新的科学问题。

 

热切期待AlphaFold继续帮助科学界解锁下一步的发现。


参考资料:

https://deepmind.com/blog/article/putting-the-power-of-alphafold-into-the-worlds-hands

https://www.nature.com/articles/s41586-021-03828-1_reference.pdf


OpenCV学堂 专注计算机视觉开发技术分享,技术框架使用,包括OpenCV,Tensorflow,Pytorch教程与案例,相关算法详解,最新CV方向论文,硬核代码干货与代码案例详解!作者在CV工程化方面深度耕耘15年,感谢您的关注!
评论 (0)
  •   效能评估系统:量化效能、驱动决策的关键利器   效能评估系统作为一种用于量化剖析、评判以及优化系统或组织效能的专业工具,借助数学建模、数据分析、仿真模拟等一系列技术手段,全方位地对目标系统在特定任务或环境下的表现进行评估,为科学决策提供坚实依据。下面从核心功能、技术架构、应用场景及发展趋势四个关键层面展开详细介绍。   应用案例   目前,已有多个效能评估系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润效能评估系统。这些成功案例为效能评估系统的推广和应用提供了有力支持。
    华盛恒辉l58ll334744 2025-04-10 11:35 20浏览
  • 什么是车用高效能运算(Automotive HPC)?高温条件为何是潜在威胁?作为电动车内的关键核心组件,由于Automotive HPC(CPU)具备高频高效能运算电子组件、高速传输接口以及复杂运算处理、资源分配等诸多特性,再加上各种车辆的复杂应用情境等等条件,不难发见Automotive HPC对整个平台讯号传输实时处理、系统稳定度、耐久度、兼容性与安全性将造成多大的考验。而在各种汽车使用者情境之中,「高温条件」就是你我在日常生活中必然会面临到的一种潜在威胁。不论是长时间将车辆停放在室外的高
    百佳泰测试实验室 2025-04-10 15:09 161浏览
  • 文/Leon编辑/侯煜‍关税大战一触即发,当地时间4月9日起,美国开始对中国进口商品征收总计104%的关税。对此,中国外交部回应道:中方绝不接受美方极限施压霸道霸凌,将继续采取坚决有力措施,维护自身正当权益。同时,中国对原产于美国的进口商品加征关税税率,由34%提高至84%。随后,美国总统特朗普在社交媒体宣布,对中国关税立刻提高至125%,并暂缓其他75个国家对等关税90天,在此期间适用于10%的税率。特朗普政府挑起关税大战的目的,实际上是寻求制造业回流至美国。据悉,特朗普政府此次宣布对全球18
    华尔街科技眼 2025-04-10 16:39 188浏览
  • 行业变局:从机械仪表到智能交互终端的跃迁全球两轮电动车市场正经历从“功能机”向“智能机”的转型浪潮。数据显示,2024年智能电动车仪表盘渗透率已突破42%,而传统LED仪表因交互单一、扩展性差等问题,难以满足以下核心需求:适老化需求:35%中老年用户反映仪表信息辨识困难智能化缺口:78%用户期待仪表盘支持手机互联与语音交互成本敏感度:厂商需在15元以内BOM成本实现功能升级在此背景下,集成语音播报与蓝牙互联的WT2605C-32N芯片方案,以“极简设计+智能交互”重构仪表盘技术生态链。技术破局:
    广州唯创电子 2025-04-11 08:59 228浏览
  •   海上电磁干扰训练系统:全方位解析      海上电磁干扰训练系统,作为模拟复杂海上电磁环境、锻炼人员应对电磁干扰能力的关键技术装备,在军事、科研以及民用等诸多领域广泛应用。接下来从系统构成、功能特点、技术原理及应用场景等方面展开详细解析。   应用案例   系统软件供应可以来这里,这个首肌开始是幺伍扒,中间是幺幺叁叁,最后一个是泗柒泗泗,按照数字顺序组合就可以找到。   一、系统构成   核心组件   电磁信号模拟设备:负责生成各类复杂的电磁信号,模拟海上多样
    华盛恒辉l58ll334744 2025-04-10 16:45 276浏览
  • 由西门子(Siemens)生产的SIMATIC S7 PLC在SCADA 领域发挥着至关重要的作用。在众多行业中,SCADA 应用都需要与这些 PLC 进行通信。那么,有哪些高效可行的解决方案呢?宏集为您提供多种选择。传统方案:通过OPC服务器与西门子 PLC 间接通信SIMATIC S7系列的PLC是工业可编程控制器,能够实现对生产流程的实时SCADA监控,提供关于设备和流程状态的准确、最新数据。S7Comm(全称S7 Communication),也被称为工业以太网或Profinet,是西门
    宏集科技 2025-04-10 13:44 198浏览
  •     电气间隙是指两个带电体在空气中的最短距离。导体、电介质(空气),最短距离,就是这个术语的要素了。        (图源:TI)    电气间隙是由安装类别决定的,或者更本质地说,是瞬态过电压的最大值来决定的,而不是工作电压的高低。安装类别见协议标准第007篇,瞬态过电压另见协议标准第009篇。    实际设计中怎么确定电气间隙?可以按照CAT,工作电压和绝缘等级来定。 
    电子知识打边炉 2025-04-13 18:01 43浏览
  • 华为Freebuds pro 耳机拆解 2020年双十一花了1000大洋买了华为的Freebuds pro,这个耳机的降噪效果真是杠杠的。完全听不到外边的噪音。几年后当我再次使用这款耳机的时候。发现左耳没带多久就自动断连了。后来查了小红书说耳机的电池没电了导致,需要重新配一只,华为售后不支持维修支持更换。而且配件的价格要好几百。真是欲哭无泪,还没用多久呢。后来百度了都说这个不是很好拆(没有好工具的前提下)。 虽然网上已经有很多拆解的视频和介绍了,今天我还是要拆解看看里面是怎么样的构造(暴力)。拿
    zhusx123 2025-04-12 23:20 35浏览
  • 相信很多小伙伴都用过下面这个MOS管开关电路,但是有多少小伙伴了解在MOS管开关过程中,输入电压、输出电压和MOS管上的电流都是怎么变化的?特别是输出端有大负载电容时,最大浪涌电流能到多少呢?今天小编专门写一篇文章,通过理论结合仿真的方式给大家分析下~首先建立一个电路图:假定电源电压V5=12V,内阻Rs=10毫欧;MOS管的导通与关闭由$V_6$控制;负载设定为100mF电容+$12\Omega$电阻。上升阶段当控制信号输出高电平时,$V_6$电压会逐渐上升,当电压上升到三极管$Q_3$的门槛
    龙猫讲电子 2025-04-11 23:01 48浏览
  • MASSAGE GUN 筋膜枪拆解 今天给车子做保养,厂家送了一个筋膜枪。产品拿在手里还是挺有分量的。标价108元。通过海鲜市场一搜索,几十元不等,而且还是爆款。不多说,我们就来看看里面用了什么料,到底值几个钱。外观篇 首先给它来个开箱照,从外观看,确实还是很精致,一点都不逊色品牌产品。 从箱中取出筋膜枪,沉甸甸的。附上产品的各方位视角 产品的全家福 我装上球头,使用了一番,还真不赖,有不同的敲击速度和根据力度调节不同的档位。拆解篇 拿出我的螺丝套装,对产品开始进行拆解,首先
    zhusx123 2025-04-13 16:52 41浏览
  • 迈向可持续未来的征程中,可再生能源已成为全球发展的基石。在可再生能源中,太阳能以其可及性和潜力脱颖而出。光伏(PV)逆变器是太阳能系统的核心,它严重依赖先进技术将太阳能电池板的直流电转换为可用的交流电。隔离栅极驱动器就是这样一种技术,它在提高这些系统的效率、安全性和可靠性方面发挥着至关重要的作用。了解隔离栅极驱动器隔离栅极驱动器是一种专用电路,可提供驱动功率晶体管(例如MOSFET或IGBT)所需的控制信号,同时确保控制侧和电源侧之间的电气隔离。这种隔离对于维护安全性、减少电磁干扰和防止高压环境
    腾恩科技-彭工 2025-04-11 16:16 43浏览
  • 技术原理:非扫描式全局像的革新Flash激光雷达是一种纯固态激光雷达技术,其核心原理是通过面阵激光瞬时覆盖探测区域,配合高灵敏度传感器实现全局三维成像。其工作流程可分解为以下关键环节:1. 激光发射:采用二维点阵光源(如VCSEL垂直腔面发射激光器),通过光扩散器在单次脉冲中发射覆盖整个视场的面阵激光,视场角通常可达120°×75°,部分激光雷达产品可以做到120°×90°的超大视场角。不同于传统机械扫描或MEMS微振镜方案,Flash方案无需任何移动部件,直接通过电信号控制激光发射模式。2.
    robolab 2025-04-10 15:30 233浏览
  • 行业痛点:电动车智能化催生语音交互刚需随着全球短途出行市场爆发式增长,中国电动自行车保有量已突破3.5亿辆。新国标实施推动行业向智能化、安全化转型,传统蜂鸣器报警方式因音效单一、缺乏场景适配性等问题,难以满足用户对智能交互体验的需求。WT2003HX系列语音芯片,以高性能处理器架构与灵活开发平台,为两轮电动车提供从基础报警到智能交互的全栈语音解决方案。WT2003HX芯片技术优势深度解读1. 高品质硬件性能,重塑语音交互标准搭载32位RISC处理器,主频高达120MHz,确保复杂算法流畅运行支持
    广州唯创电子 2025-04-10 09:12 259浏览
  • 背景近年来,随着国家对资源、能源有效利用率的要求越来越高,对环境保护和水处理的要求也越来越严格,因此有大量的固液分离问题需要解决。真空过滤器是是由负压形成真空过滤的固液分离机械。用过滤介质把容器分为上、下两层,利用负压,悬浮液加入上腔,在压力作用下通过过滤介质进入下腔成为滤液,悬浮液中的固体颗粒吸附在过滤介质表面形成滤饼,滤液穿过过滤介质经中心轴内部排出,达到固液分离的目的。目前市面上的过滤器多分为间歇操作和连续操作两种。间歇操作的真空过滤机可过滤各种浓度的悬浮液,连续操作的真空过滤机适于过滤含
    宏集科技 2025-04-10 13:45 163浏览
  •   天空卫星健康状况监测维护管理系统:全方位解析  在航天技术迅猛发展的当下,卫星在轨运行的安全与可靠至关重要。整合多种技术,实现对卫星的实时监测、故障诊断、健康评估以及维护决策,有力保障卫星长期稳定运转。  应用案例       系统软件供应可以来这里,这个首肌开始是幺伍扒,中间是幺幺叁叁,最后一个是泗柒泗泗,按照数字顺序组合就可以找到。  一、系统架构与功能模块  数据采集层  数据处理层  智能分析层  决策支持层  二、关键技术  故障诊断技术  
    华盛恒辉l58ll334744 2025-04-10 15:46 177浏览
我要评论
0
3
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦