爆点资讯

新智元报道

编辑：alan

【新智元导读】人工智能模型一直以「黑匣子」的形态让人们感到不安，AI到底从数据中学到了什么？又是如何作出推理？最新研究为你揭秘AI的内部原理

人工智能（AI）一直在迅速发展，但对人类来说，强大的模型却是个「黑匣子」。

我们不了解模型内部的运作原理，不清楚它得出结论的过程。

然而最近，波恩大学（University of Bonn）的化学信息学专家Jürgen Bajorath教授和他的团队取得了重大突破。

他们设计了一种技术，揭示了药物研究中使用的某些人工智能系统的运行机制。

他们的研究结果表明，这些人工智能模型主要依赖于回忆现有数据，而不是学习特定的化学相互作用，来预测药物的有效性。

——也就是说，AI预测纯靠拼凑记忆，机器学习实际上并没有学习！

他们的研究结果最近发表在《自然机器智能》（Nature Machine Intelligence）杂志上。

论文地址：https://www.nature.com/articles/s42256-023-00756-9

在医药领域，研究人员正在狂热地寻找有效的活性物质来对抗疾病——哪种药物分子最有效？

通常，这些有效的分子（化合物）会对接在蛋白质上，蛋白质作为触发特定生理作用链的酶或受体。

在特殊情况下，某些分子还负责阻断体内的不良反应，例如过度的炎症反应。

可能的化合物数量巨大，寻找有效的化合物就像大海捞针一样。

因此，研究人员首先使用AI模型来预测，哪些分子最能与各自的靶蛋白对接并牢固结合。然后在实验研究中，更详细地进一步筛选这些候选药物。

自人工智能发展以来，药物发现研究也越来越多地采用AI相关的技术。

比如图神经网络（GNN），适用于预测某种分子与靶蛋白结合的强度。

图由表示对象的节点和表示节点之间关系的边组成。在蛋白质与配体复合物的图表示中，图的边连接蛋白质或配体节点，表示物质的结构，或者蛋白质和配体之间的相互作用。

GNN模型使用从X射线结构中提取的蛋白质配体相互作用图，来预测配体亲和力。

Jürgen Bajorath教授表示，GNN模型对于我们来说就像一个黑匣子，我们无法得知它如何得出自己的预测。

Jürgen Bajorath教授任职于波恩大学LIMES研究所、波恩-亚琛国际信息技术中心（Bonn-Aachen International Center for Information Technology）和拉玛机器学习与人工智能研究所（Lamarr Institute for Machine Learning and Artificial Intelligence）。

人工智能如何工作？

来自波恩大学化学信息学的研究人员，与罗马Sapienza大学的同事一起，详细分析了图神经网络是否真的学习到了蛋白质与配体的相互作用。

研究人员使用他们专门开发的「EdgeSHAPer」方法分析了总共六种不同的GNN架构。

EdgeSHAPer程序可以判断GNN是否学习了化合物和蛋白质之间最重要的相互作用，或者是通过其他的方式来得出预测。

科学家们使用从蛋白质配体复合物结构中提取的图训练了六个GNN，——化合物的作用方式以及与靶蛋白的结合强度已知。

然后，在其他复合物上测试经过训练的GNN，并使用EdgeSHAPer分析GNN如何产生预测。

「如果GNN按照预期行事，它们需要学习化合物和靶蛋白之间的相互作用，并且通过优先考虑特定的相互作用来给出预测」。

然而，根据研究小组的分析，六个GNN基本上都没有做到这一点。大多数GNN只学会了一些蛋白质与药物的相互作用，主要集中在配体上。

上图展示了在6个GNN中的实验结果，色标条表示用EdgeSHAPer确定的每个预测的前25个边中蛋白质、配体和相互作用所占的平均比例。

我们可以看到，代表绿色的相互作用本该是模型需要学到的，然而在整个实验中所占的比例都不高，而代表配体的橙色条占了最大的比例。

为了预测分子与靶蛋白的结合强度，模型主要「记住」了它们在训练过程中遇到的化学相似分子及其结合数据，而不管靶蛋白如何。这些被记住的化学相似性基本上决定了预测。

这让人想起「聪明的汉斯效应」（Clever Hans effect），——就像那匹看起来会数数的马，实际上是根据同伴面部表情和手势的细微差别，来推断出预期的结果。

这或许意味着，GNN所谓的「学习能力」可能是站不住脚的，模型的预测在很大程度上被高估了，因为可以使用化学知识和更简单的方法进行同等质量的预测。

不过，研究中也发现了另外一个现象：当测试化合物的效力增加时，模型倾向于学习到更多的相互作用。

也许通过修改表征和训练技术，这些GNN还能朝着理想的方向进一步改进。不过，对于可以根据分子图学习物理量的假设，一般来说应该谨慎对待。

「人工智能不是黑魔法。」

参考资料：

https://scitechdaily.com/decoding-the-black-box-of-ai-scientists-uncover-unexpected-results/

AI并没有学习！Nature子刊最新研究解码人工智能黑盒

俄媒：美国社...

牛弹琴：马英...

女生最显土的...

红毯礼服造型...

娜扎穿牛仔外...

哈登愿意被交...

林心如带女儿拍广告惹争议,为何被骂又当又立?

台媒称解放军围台有新战术:演练控制＂一岛三峡＂

记者：加拉塔萨雷租借恩东贝莱达协议，选择买断费1500万欧

环球：日本没有资格对中国军费说三道四

殷世航快手账号被封禁，快手：平台接到用户23万条举报信

点进来，查看欧阳娜娜、杨采钰的秋装进度!

已伤缺一个多月！Shams：加兰计划在周四对阵活塞的比赛中复出

《大话西游》中朱茵扮演了青霞和紫霞，可是很多人都不知道她还在里面扮演了猪八戒

曝绿凯将续约布朗！美记直言布朗>比尔：联盟22号球星绝配2.9亿

美军无人机午夜侦察南海是怎么回事？中方对此如何回应？

5岁女童＂站下腰＂摔倒致高位截瘫培训机构被判赔210万

年过四十岁的女人，夏天多穿这些“过膝裙”，越老越气质优雅

邮报：欧文儿子因眼部疾病，放弃成为足球运动员

MG4 EV，涉过汹涌的海

央行重磅会议释放新信号！下半年行情开门红可期？

衬衫短裤才是入夏的时髦组合优雅有气质

小米品牌安全官微更名，“小米法务部”正式上线

瑞泰人寿任期超六年总经理离职！前三季净亏0.39亿，稳住局面靠什么

人民币汇率强势反弹逾300个基点汇率暂别连跌走势

市监总局：规范新能源汽车检测收费严查违法行为

夺冠5天，《周处除三害》被赶下宝座，《沙丘2》7小时票房2115万

今日热点：杨紫对接辟谣出演《风月不相关》；易烊千玺出现在新闻联播镜头......

美妆胶卷 | 呈熠精致璀璨的眼妆，让双眸绽耀无尽魅力。

手感冰凉！德罗赞19中5得到19分4板4助