AI生图太诡异?马里兰&NYU合力解剖神经网络,CLIP模型神经元形似骷髅头

OpenCV学堂 2023-11-03 21:34



点击上方↑↑↑OpenCV学堂”关注我

来源:公众号 新智元 授权


【导读】神经网络黑盒怎么解释?马里兰大学和NYU研究人员开启了新的尝试。

AI黑盒如何才能解?
神经网络模型在训练的时,会有些ReLU节点「死亡」,也就是永远输出0,不再有用。
它们往往会被被删除或者忽略。
恰好赶上了模糊了生与死的界限的节日——万圣节,所以这是探索那些「死节点」的好时机。
对于大多数图像生成模型来说,会输出正面的图像。但是优化算法,可以让模型生成更多诡异、恐怖的图像。
就拿CLIP模型来说,可以衡量一段文本和一张图片的匹配程度。
给定一段描述怪诞场景的文本,使用优化算法通过最小化CLIP的损失,来生成一张与这段文本匹配的、吓人的图片。
当你不断探索损失函数的最深最恐怖的区域,就像进入了一个疯狂的状态。
就会发现这些诡异图片超乎想象。
最重要的是,它们仅仅是通过CLIP模型优化生成,并没有借助其他的模型。
优化算法,可以让我们对神经网络进行「解剖」,特征可视化(feature visualization)可以找到一个最大激活单个神经元的图像。
吴恩达和Jeff Dean曾在2012年就ImageNet图像分类模型上做过这样的实验,并发现了一个对黑色猫有响应的神经元。
对此,来自马里兰大学和NYU的研究人员使用「特征可视化」来剖析CLIP模型,发现了一个非常令人不安的神经元:
完全是一个类似骷髅头的图像。
但它真的是「骷髅头神经元」吗?显然不是,实际上它代表的是某种更加神秘、难以解释的模式。
究竟怎么回事?

模型反转,卷积网ViT不适用


想要解释AI生成的图像,需要用到的一种手段——模型反转(model inversion)。

「模型反转」是可视化和解释神经架构内部行为、理解模型学到的内容,以及解释模型行为的重要工具。
一般来说,「模型反转」通常寻找可以激活网络中某个特征的输入(即特征可视化),或者产生某个特定类别的高输出响应(即类别反转)。
然鹅,神经网络架构不断发展,为现有的「模型反转」方案带来了重大挑战。
卷积网长期以来,一直是CV任务的默认方法,也是模型反转领域研究的重点。
随着Vision Transformer(ViT)、MLP-Mixer、ResMLP等其他架构的出现,大多数现有的模型反转方法不能很好地应用到这些新结构上。
总而言之,当前需要研发可以应用到新结构上的模型反转方法。
对此,马里兰和NYU研究人员将关注点放在了「类反转」(class inversion)。
目标是,在不知道模型训练数据的情况下,找到可以最大化某个类别输出分数的可解释图像。
类反转已在模型解释、图像合成等任务中应用,但是存在几个关键缺陷:生成图像质量对正则化权重高度敏感;需要批标准化参数的方法不适用于新兴架构。
研究人员再此提出了基于数据增强的类反转方法——Plug-In Inversion(PII)。

论文地址:https://arxiv.org/pdf/2201.12961.pdf
PII的好处在于不需要明确的正则化,因此不需要为每个模型或图像实例调节超参数。
实验结果证明,PII可以使用相同的架构无关方法和超参数反转CNN、ViT和MLP架构。

全新类反转——PII


此前,关于类反转的研究,常常使用抖动之类的增强功能。
它会在水平和垂直方向上随机移动图像,以及水平Ips来提高反转图像的质量。
在最新研究中,作者探讨了有利于反转的其他增强,然后再描述如何将它们组合起来形成PII算法。
限制搜索空间
作者考虑2种增强方法来提高倒置图像的空间质量——居中(Centering)和缩放(Zoom)。
这些方法的设计基于这样的假设:限制输入优化空间,可以得到更好的特征布局。
两种方法都从小尺寸开始,逐步扩大空间,迫使放置语义内容在中心,目的是生成更具解释性和可识别性的反转图像。
图1和图2分别显示了,居中和缩放过程中每个步骤测图像状态。
ColorShift增强
之前展示的反转图像,颜色看起来很不自然。
这是由于研究人员现在提出的一种全新增强方法——ColorShift造成的。
ColorShift是随机扰动每个颜色通道的平均值和方差,改变图像颜色,目的是生成更丰富多样的反转图像颜色。
下图,作者可视化了ColorShift的稳定效果。
集成
集成是一种成熟的工具,经常用于从增强推理到数据集安全等应用程序。
研究人员发现,优化由同一图像的不同ColorShift组成的整体,可以同时提高反转方法的性能。
图4显示了与ColorShift一起应用集成的结果。
可以观察,到较大的集成似乎给出了轻微的改进,但即使是大小为1或2的集成,也能产生令人满意的结果。
这对于像ViT这样的模型很重要,因为可用的GPU内存限制了该集合的可能大小。
到这里,你就明白什么是PII了,即结合了抖动、集成、ColorShift、居中和缩放技术,并将结果命名为「插件反转」。
它可以应用到任何可微分模型(包括ViT和MLP),只需要一组固定超参数。

多种网络架构适用


那么,PII效果究竟如何?
实验结果发现,PII可以应用于不同的模型。需要强调是的是,研究者在所有情况下都对PII参数使用相同的设置。
图6中,描绘了通过反转各种架构的Volcano类生成的图像,包括CNN、ViT和MLP的示例。
虽然不同神经网络的图像质量有所不同,但它们都包含可区分,且位置恰当的视觉信息。
在图7中,研究人员还显示了PII从几个任意ImageNet类的每种主要架构类型的代表生成的图像。
可以看到,每行有独特视觉风格,说明模型反转可以用来理解不同模型的学习信息。
在图8中,作者使用PII来反转在ImageNet上训练,并在CIFAR-100上进行微调的ViT模型。
图9显示了在CIFAR-10上微调的模型的反转结果。
为了定量评估全新方法,作者反转预训练的ViT模型和预训练的ResMLP模型,使用PII为每个类生成一张图像,并使用DeepDream执行相同的操作。
然后使用各种预训练的模型对这些图像进行分类。
表1包含这些模型的平均top-1和top-5分类精度,以及每种方法生成的图像的初始分数。
图10显示了PII和DeepInversion生成的一些任意类别的图像。
参考资料:

https://twitter.com/tomgoldsteincs/status/1719033932467888220

https://arxiv.org/pdf/2201.12961.pdf

OpenCV学堂 专注计算机视觉开发技术分享,技术框架使用,包括OpenCV,Tensorflow,Pytorch教程与案例,相关算法详解,最新CV方向论文,硬核代码干货与代码案例详解!作者在CV工程化方面深度耕耘15年,感谢您的关注!
评论
  • By Toradex 秦海1). 简介嵌入式平台设备基于Yocto Linux 在开发后期量产前期,为了安全以及提高启动速度等考虑,希望将 ARM 处理器平台的 Debug Console 输出关闭,本文就基于 NXP i.MX8MP ARM 处理器平台来演示相关流程。 本文所示例的平台来自于 Toradex Verdin i.MX8MP 嵌入式平台。  2. 准备a). Verdin i.MX8MP ARM核心版配合Dahlia载板并
    hai.qin_651820742 2025-01-07 14:52 102浏览
  • 根据环洋市场咨询(Global Info Research)项目团队最新调研,预计2030年全球无人机锂电池产值达到2457百万美元,2024-2030年期间年复合增长率CAGR为9.6%。 无人机锂电池是无人机动力系统中存储并释放能量的部分。无人机使用的动力电池,大多数是锂聚合物电池,相较其他电池,锂聚合物电池具有较高的能量密度,较长寿命,同时也具有良好的放电特性和安全性。 全球无人机锂电池核心厂商有宁德新能源科技、欣旺达、鹏辉能源、深圳格瑞普和EaglePicher等,前五大厂商占有全球
    GIRtina 2025-01-07 11:02 115浏览
  • 「他明明跟我同梯进来,为什么就是升得比我快?」许多人都有这样的疑问:明明就战绩也不比隔壁同事差,升迁之路却比别人苦。其实,之间的差异就在于「领导力」。並非必须当管理者才需要「领导力」,而是散发领导力特质的人,才更容易被晓明。许多领导力和特质,都可以通过努力和学习获得,因此就算不是天生的领导者,也能成为一个具备领导魅力的人,进而被老板看见,向你伸出升迁的橘子枝。领导力是什么?领导力是一种能力或特质,甚至可以说是一种「影响力」。好的领导者通常具备影响和鼓励他人的能力,并导引他们朝着共同的目标和愿景前
    优思学院 2025-01-08 14:54 55浏览
  • 村田是目前全球量产硅电容的领先企业,其在2016年收购了法国IPDiA头部硅电容器公司,并于2023年6月宣布投资约100亿日元将硅电容产能提升两倍。以下内容主要来自村田官网信息整理,村田高密度硅电容器采用半导体MOS工艺开发,并使用3D结构来大幅增加电极表面,因此在给定的占位面积内增加了静电容量。村田的硅技术以嵌入非结晶基板的单片结构为基础(单层MIM和多层MIM—MIM是指金属 / 绝缘体/ 金属) 村田硅电容采用先进3D拓扑结构在100um内,使开发的有效静电容量面积相当于80个
    知白 2025-01-07 15:02 140浏览
  • 在智能家居领域中,Wi-Fi、蓝牙、Zigbee、Thread与Z-Wave等无线通信协议是构建短距物联局域网的关键手段,它们常在实际应用中交叉运用,以满足智能家居生态系统多样化的功能需求。然而,这些协议之间并未遵循统一的互通标准,缺乏直接的互操作性,在进行组网时需要引入额外的网关作为“翻译桥梁”,极大地增加了系统的复杂性。 同时,Apple HomeKit、SamSung SmartThings、Amazon Alexa、Google Home等主流智能家居平台为了提升市占率与消费者
    华普微HOPERF 2025-01-06 17:23 195浏览
  • 彼得·德鲁克被誉为“现代管理学之父”,他的管理思想影响了无数企业和管理者。然而,关于他的书籍分类,一种流行的说法令人感到困惑:德鲁克一生写了39本书,其中15本是关于管理的,而其中“专门写工商企业或为企业管理者写的”只有两本——《为成果而管理》和《创新与企业家精神》。这样的表述广为流传,但深入探讨后却发现并不完全准确。让我们一起重新审视这一说法,解析其中的矛盾与根源,进而重新认识德鲁克的管理思想及其著作的真正价值。从《创新与企业家精神》看德鲁克的视角《创新与企业家精神》通常被认为是一本专为企业管
    优思学院 2025-01-06 12:03 155浏览
  • 这篇内容主要讨论三个基本问题,硅电容是什么,为什么要使用硅电容,如何正确使用硅电容?1.  硅电容是什么首先我们需要了解电容是什么?物理学上电容的概念指的是给定电位差下自由电荷的储藏量,记为C,单位是F,指的是容纳电荷的能力,C=εS/d=ε0εrS/4πkd(真空)=Q/U。百度百科上电容器的概念指的是两个相互靠近的导体,中间夹一层不导电的绝缘介质。通过观察电容本身的定义公式中可以看到,在各个变量中比较能够改变的就是εr,S和d,也就是介质的介电常数,金属板有效相对面积以及距离。当前
    知白 2025-01-06 12:04 214浏览
  • 故障现象一辆2017款东风风神AX7车,搭载DFMA14T发动机,累计行驶里程约为13.7万km。该车冷起动后怠速运转正常,热机后怠速运转不稳,组合仪表上的发动机转速表指针上下轻微抖动。 故障诊断 用故障检测仪检测,发动机控制单元中无故障代码存储;读取发动机数据流,发现进气歧管绝对压力波动明显,有时能达到69 kPa,明显偏高,推断可能的原因有:进气系统漏气;进气歧管绝对压力传感器信号失真;发动机机械故障。首先从节气门处打烟雾,没有发现进气管周围有漏气的地方;接着拔下进气管上的两个真空
    虹科Pico汽车示波器 2025-01-08 16:51 56浏览
  • 大模型的赋能是指利用大型机器学习模型(如深度学习模型)来增强或改进各种应用和服务。这种技术在许多领域都显示出了巨大的潜力,包括但不限于以下几个方面: 1. 企业服务:大模型可以用于构建智能客服系统、知识库问答系统等,提升企业的服务质量和运营效率。 2. 教育服务:在教育领域,大模型被应用于个性化学习、智能辅导、作业批改等,帮助教师减轻工作负担,提高教学质量。 3. 工业智能化:大模型有助于解决工业领域的复杂性和不确定性问题,尽管在认知能力方面尚未完全具备专家级的复杂决策能力。 4. 消费
    丙丁先生 2025-01-07 09:25 111浏览
  •  在全球能源结构加速向清洁、可再生方向转型的今天,风力发电作为一种绿色能源,已成为各国新能源发展的重要组成部分。然而,风力发电系统在复杂的环境中长时间运行,对系统的安全性、稳定性和抗干扰能力提出了极高要求。光耦(光电耦合器)作为一种电气隔离与信号传输器件,凭借其优秀的隔离保护性能和信号传输能力,已成为风力发电系统中不可或缺的关键组件。 风力发电系统对隔离与控制的需求风力发电系统中,包括发电机、变流器、变压器和控制系统等多个部分,通常工作在高压、大功率的环境中。光耦在这里扮演了
    晶台光耦 2025-01-08 16:03 48浏览
  • 每日可见的315MHz和433MHz遥控模块,你能分清楚吗?众所周知,一套遥控设备主要由发射部分和接收部分组成,发射器可以将控制者的控制按键经过编码,调制到射频信号上面,然后经天线发射出无线信号。而接收器是将天线接收到的无线信号进行解码,从而得到与控制按键相对应的信号,然后再去控制相应的设备工作。当前,常见的遥控设备主要分为红外遥控与无线电遥控两大类,其主要区别为所采用的载波频率及其应用场景不一致。红外遥控设备所采用的射频信号频率一般为38kHz,通常应用在电视、投影仪等设备中;而无线电遥控设备
    华普微HOPERF 2025-01-06 15:29 160浏览
  • 本文介绍编译Android13 ROOT权限固件的方法,触觉智能RK3562开发板演示,搭载4核A53处理器,主频高达2.0GHz;内置独立1Tops算力NPU,可应用于物联网网关、平板电脑、智能家居、教育电子、工业显示与控制等行业。关闭selinux修改此文件("+"号为修改内容)device/rockchip/common/BoardConfig.mkBOARD_BOOT_HEADER_VERSION ?= 2BOARD_MKBOOTIMG_ARGS :=BOARD_PREBUILT_DTB
    Industio_触觉智能 2025-01-08 00:06 87浏览
  • 根据Global Info Research项目团队最新调研,预计2030年全球封闭式电机产值达到1425百万美元,2024-2030年期间年复合增长率CAGR为3.4%。 封闭式电机是一种电动机,其外壳设计为密闭结构,通常用于要求较高的防护等级的应用场合。封闭式电机可以有效防止外部灰尘、水分和其他污染物进入内部,从而保护电机的内部组件,延长其使用寿命。 环洋市场咨询机构出版的调研分析报告【全球封闭式电机行业总体规模、主要厂商及IPO上市调研报告,2025-2031】研究全球封闭式电机总体规
    GIRtina 2025-01-06 11:10 120浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦