【光电智造】基于深度学习的工业图像异常定位(检测)综述

今日光电 2024-08-08 18:03

 今日光电 

     有人说,20世纪是电的世纪,21世纪是光的世纪;知光解电,再小的个体都可以被赋能。追光逐电,光赢未来...欢迎来到今日光电!




----追光逐电 光赢未来----

 异常定位的定义

什么是AL?

人类视觉系统具有感知异常的固有能力——人不仅可以区分缺陷图像和非缺陷图像,即使他们以前从未见过任何缺陷样本,而且还可以很容易的指出图像中那些位置存在异常。异常定位(AL,anomaly localization)被引入学术界也是出于同样的目的,即教会机器以无监督的方式“发现”异常区域。在深度学习方法中,“无监督”意味着训练阶段只包含正常图像,没有任何缺陷样本。无监督范式下的AL方法首先避免了收集异常或缺陷样本的困难,这在监督方法中是无法避免的;因为在工业场景中,没有缺陷的正常图像远远多于异常样本。其次,在无监督方法中可以消除监督方法中训练样本的标记成本。最后,无监督方法还避免了标记偏差的影响,这在监督方法中常见。由于训练数据只有正常类,因此可以将其称为“半监督”。然而,为了与大多数现有方法统一,我们在以下内容中删除了术语“无监督”或“半监督”,仅将其称为AL。

AD和AL的区别:计算机视觉中异常检测AD(anomaly detection)也常常被提及,离群点检测或one class 分类是AD的其他术语。图1展示了AD(anomaly detection)和AL之间的区别。AD是指在图像级别将缺陷图像与大多数非缺陷图像区分开来的任务,只关注图像类别,正常or异常。另一方面,AL也称为异常分割,用于生成像素级异常定位结果,它不仅仅关注图像类别,更关注异常的详细位置。异常热图中的颜色越深,如图1所示,该位置存在异常的可能性越大。

什么是异常?

一般来说,工业领域中的异常通常指缺陷,这里不仅仅包括三伤(划伤、碰伤和压伤等),异色,亮痕等纹理变化的缺陷,而且有更为复杂的,需要进一步逻辑判断的功能缺陷。例如晶体管管脚是否插入到pin中,是否装错,装反或少装。下图第一行展示了MVTec AD数据集上的纹理缺陷,第二行展示了MVTec AD数据集上的功能缺陷。MVTec AD中大部分缺陷类型为纹理缺陷,少部分缺陷为功能缺陷,功能缺陷主要存在晶体管这个数据集中,因此这个数据集是MVTec AD15个数据集中最难检测的。

上图追溯了工业图像的AL的历史。大多数基于非深度学习的AL模型依赖于稀疏编码[14,15]和字典学习[16]。自2017年以来,由于深度学习技术在计算机视觉领域的巨大成功,出现了越来越多的深度学习方法[19]。GAN模型[17,22]和AE重建网络[18]首次用于深度AL模型。为了一致地比较AL的影响,MTVec公司提出了一个完整的工业AL数据集,也就是MVTec AD数据集[20]。后来,基于特征嵌入的模型变得更加有效和高效,成为流行的AL架构。知识蒸馏[21,26]和预训练特征比较[23,25,30]是典型模型的示例。然后,将几种基于自监督学习的方法应用于上述任务[24,29]。基于Flow的生成模型[28]和ViT模型[27]作为更好的方法也嵌入到AL网络中。尽管AL研究的历史很短,但它已经发表了数百篇论文,我们综合选择了在著名杂志和会议上发表的有影响力的论文;这项调查侧重于过去五年的主要进展。由于MVTec AD数据集的提出,在过去的两年内,大量方法呈现井喷状态被提出,该数据集的指标也被刷到非常高,这一点可以从paper with code网站 (https://paperswithcode.com/sota/anomaly-detection-on-mvtec-ad)看出。

这篇综述和以往综述有什么区别?

文章中列出了与AD/AL相关的多项综述,涉及早期非深度学习AD方法[6]、基于深度学习的AD方法[5,7-9]、有限的AL模型[10]或仅关注GAN的AD/AL[11]等领域的研究。然而,很少有综述致力于完整和全面的异常定位AL方法。另一方面,大多数现有综述仅仅关注图像级分类的AD方法,该方法很容易忽略工业场景中的细微异常区域。此外,近五年来,所有方法已经从图像级比较(重建或生成)发展到特征级比较,也从简单的缺陷合成代理任务发展到基于对比学习的自监督方法。我们的工作系统全面地回顾了无监督人工智能的最新进展。其中包括对该领域以前从未探索过的许多方面的深入分析和讨论。特别是,我们总结和讨论了解决各种问题和挑战的现有方法,提供了路线图和分类,回顾了现有的数据集和评估指标,对最先进的方法进行了全面的性能比较,并对未来的方向提出了见解。我们希望我们的综述能够提供新的见解和灵感,促进深入了解AL,并鼓励对本文提出的开放主题进行研究。

代表性方法的分类

我们将目前的方法分为5大子方法,并对每个子方法进行了详细的介绍和对比分析。在每个小节中,我们对其代表文章进行了进一步细分。然而,有些工作属于不止一个类别。因此,我们利用文章中图4的维恩图划分工作,重叠区域包括方法的交叉部分。

主要包括:

1)基于图像重建的方法:这是最早出现的方法,也非常直观,期待AE自动编码器能够对异常图像重建成正常图像,然后重建图像和正常图像作差,得到定位结果。主要的改进包括网络结构、隐空间和损失函数的改进。该方法的问题在于难以保证异常图像中的异常区域被很好重建为正常,同时图像中的正常区域重建的效果和输入一致,这样两者作差的结果并不能完全代表异常区域。

2)基于生成网络的方法:代表的方法就是VAE、GAN和Normalizing Flow (NF)。VAE中引入了类似CAM这种求梯度方式来判断异常位置的方法。GAN主要是通过多个生成器和判别器的设置,来提升生成或重建的图像效果。然而,GAN和VAE都缺乏对概率分布的精确评估和推理,这往往导致VAE中的模糊结果质量不高,GAN训练也面临着如模式崩溃和后置崩溃等挑战。NF能够较好的解决上述问题,同时NF会和后面的基于特征的方法进行结合,也是目前在MVTec AD上取得效果最好的方法。

3)基于深度特征建模的方法:主要包括知识蒸馏和特征建模两大类。特别是特征建模,可以细分为很多小类,例如:KNN,SOM,高斯建模等,详细的内容可以见文章。

4)基于自监督的方法:主要分为代理任务和对比学习。代理任务包括常见的重建、补全、相对关系预测和属性修护等。

5)基于one-class分类的方法:这个方法主要是异常检测AD采用的,如果将图像划分为滑动窗口,所有的AD方法也适用于AL。此外,它也可以与前面4种方法相结合。

 实验评估和对比分析

数据集:准确来说常用于AL定位的数据集有三个:NanoTWICE、MVTec AD和BTAD。这三个数据集也是做AL论文中引用最多的。当然还有一些有监督的分割数据集也会被拿过来做评测,包括KolektorSDD、KolektorSDD2和MT Defect等。

MVTec AD数据集上的性能:文章中表10和11总结了目前AL方法(主要发布于2017至2021)在MVTec AD数据集上的性能。我们观察到,大多数方法在AE的帮助下达到了基线性能。一些尝试致力于设计更强大的模块,如图像修复和GAN生成网络。例如RIAD方法,在MVTec AD数据集上的像素AUROC已达到94.2%[53]。然而,实验结果表明,这些纯基于AE自动编码器的重建或生成方法很难在MVTec AD数据集上表现良好。

相比之下,基于深度特征嵌入的方法很快在AL中展示了它们的优势。过去论文中的结果表明,三种典型的特征比较方法,S-T[21]、SPADE[25]和DFR[84],在MVTec AD数据集上分别实现了93.9%、96.5%和95.0%的像素AUROC。从通用特征建模方法[23]开始,当引入更有效的策略时,基于特征嵌入的方法稳步改进,例如,将特征选择引入半正交嵌入[87]、注意力策略[23,43]、带内存库的KNN[30]、自组织特征[88]和对齐特征[92]。因此,在MVTec AD数据集上,大多数方法产生约93%的像素AUROC和91%的PRO分数。

此外,CFLOW-AD[79]与一种新型的生成网络相结合,性能优于其他最先进的模型,并实现了迄今为止MVTec AD上最好的像素AUROC。另一方面,MPAD[50]结合预先训练的功能,超越了其他最先进的模型,并在MVTec AD上取得了迄今为止最好的PRO分数。在这里,在文章中图13中,我们展示了MVTec AD上四种典型特征嵌入方法的AL结果的可视化,包括STPM[81]、PatchCore[30]、PaDiM[23]和CFLOW-AD[79]。这些结果是使用Intel corporation维护的标准图像库Anomalib[125]获得的。基于自监督学习的方法可以从未标记的图像中学习视觉特征,并作为附加模块嵌入到上述网络结构中。与原始的基于AE自动编码器的方法相比,这种方法,例如ANOSEG[98]、NSA[99]和DRAEM[29]可以获得更好的结果。此外,与图像重建或预训练特征相比,基于对比学习的方法[92107]由于异常区域的判别信息,表现出非常有竞争力的性能。基于One class分类的方法通常耗时且定位结果不准确,尤其是裁剪局部斑块和提取单个局部特征的计算时间。然而,一些方法包括更复杂的特征比较过程,例如,patch-SVDD[24]和SE-SVDD[113]。

总之,基于深度学习的人工智能方法可以通过采用不同的策略在MVTec AD数据集上获得相对满意的结果。特别是,15个数据集中有3个数据集没有被大多数方法克服;这些是瓷砖、木材和晶体管数据集。瓷砖和木材是典型的纹理数据集,包含多尺度和多类型的缺陷,目前主要方法未达到95%的AUROC。晶体管数据集具有包含高级语义信息的缺失缺陷类型,也就是功能异常。在该数据集中,它将所有缺失范围视为ground-truth。因此,目前的主要方法也没有达到理想的性能。

未来的研究方向

功能异常:从上表中提到的优缺点可以看出,许多方法的异常定位效果在某些特定数据集上显著下降。例如,DFR[84]的缺点是晶体管数据集的性能较差(参见文章表6、10)。这是因为文章表10中显示的大多数数据集是纹理缺陷,例如划痕和凹痕,而非功能异常。功能异常违反了基本约束,例如,允许的对象位于无效位置或缺少所需的对象。在工业场景中,这两种类型同等重要。目前,Bergmann等人[126]已经提出了一种联合检测纹理和功能异常的方法。因此,对功能缺陷或异常的研究将是未来的一个重要方向。

发布丰富的AL数据集:与真实行业场景相比,公共异常位置数据集还不够大或丰富。应提供具有变化成像条件(如照明、透视、比例、阴影、模糊等)的更复杂数据集,以更客观地评估AL算法的效果。现有的MVTec AD具有单成像、相对良好的图像质量和某些类别的对齐。一些现有的方法甚至利用这一特性来提高性能。尽管取得了有希望的结果,但这些方法无法适应实际复杂的工业场景。因此,有必要拥有一些现实而丰富的工业数据集。

基于ViT的方法:基于ViT的方法由于其优越的性能,目前在计算机视觉领域占据主导地位。还提出了一些基于ViT的工作[27、124、79]来解决AL问题。ViT在长距离特征建模中具有独特的优势。综合考虑多尺度异常区域是ViT可以改进的方向。此外,AL的最佳框架是基于NF的生成模型。因此,ViT和NF的结合也一直是一个重要的方向。

有意义的模型评估:如文章中图13所示,高像素AUROC值和精细的定位性能之间存在偏差,这可能会导致模型有效性问题。许多方法仍然使用像素AUROC评估指标,但AL的可视化结果表现并不佳,背景存在大量过检,也就是异常被定位出来的效果很粗,缺陷的轮廓并不精细。建议未来的工作在建立模型时考虑精细边界问题,或选择IoU度量进行模型评估。

准确的异常类型:实际工业场景中的异常类型多种多样,不同异常类型的重要性不同。现有的AD/AL方法,仅仅给出缺陷这一单一类别或位置,无法得到详细的缺陷类型,例如划伤、异物、异色等,这个问题挑战了AD或AL的经典范式,需要开发能够区分异常类型的学习方法。已有方法[122]对异常类型进行聚类,并将异常数据分组到语义一致的类别中,但这仅仅是一个开始。

无监督三维异常定位:随着三维传感器的普及,工业场景中越来越多的缺陷检测任务正在从二维场景转移到三维场景。相应地,三维场景中的人工智能也将成为一种发展趋势。最近,MVTec公司在2021年底公开了一个3D AD/AL数据集[123]。因此,我们认为3D AD/AL构成了一个相关的未来方向。

论文题目:Deep Learning for Unsupervised Anomaly Localization in Industrial Images: A Survey

发表单位:中国科学院自动化所、北京工商大学、印度理工学院

论文地址:https://arxiv.org/abs/2207.10298


来源:新机器视觉


申明:感谢原创作者的辛勤付出。本号转载的文章均会在文中注明,若遇到版权问题请联系我们处理。


 

----与智者为伍 为创新赋能----


【说明】欢迎企业和个人洽谈合作,投稿发文。欢迎联系我们
诚招运营合伙人 ,对新媒体感兴趣,对光电产业和行业感兴趣。非常有意者通过以下方式联我们!条件待遇面谈
投稿丨合作丨咨询

联系邮箱:uestcwxd@126.com

QQ:493826566



评论
  • 最近几年,新能源汽车愈发受到消费者的青睐,其销量也是一路走高。据中汽协公布的数据显示,2024年10月,新能源汽车产销分别完成146.3万辆和143万辆,同比分别增长48%和49.6%。而结合各家新能源车企所公布的销量数据来看,比亚迪再度夺得了销冠宝座,其10月新能源汽车销量达到了502657辆,同比增长66.53%。众所周知,比亚迪是新能源汽车领域的重要参与者,其一举一动向来为外界所关注。日前,比亚迪汽车旗下品牌方程豹汽车推出了新车方程豹豹8,该款车型一上市就迅速吸引了消费者的目光,成为SUV
    刘旷 2024-12-02 09:32 119浏览
  • 光伏逆变器是一种高效的能量转换设备,它能够将光伏太阳能板(PV)产生的不稳定的直流电压转换成与市电频率同步的交流电。这种转换后的电能不仅可以回馈至商用输电网络,还能供独立电网系统使用。光伏逆变器在商业光伏储能电站和家庭独立储能系统等应用领域中得到了广泛的应用。光耦合器,以其高速信号传输、出色的共模抑制比以及单向信号传输和光电隔离的特性,在光伏逆变器中扮演着至关重要的角色。它确保了系统的安全隔离、干扰的有效隔离以及通信信号的精准传输。光耦合器的使用不仅提高了系统的稳定性和安全性,而且由于其低功耗的
    晶台光耦 2024-12-02 10:40 120浏览
  • 作为优秀工程师的你,已身经百战、阅板无数!请先醒醒,新的项目来了,这是一个既要、又要、还要的产品需求,ARM核心板中一个处理器怎么能实现这么丰富的外围接口?踌躇之际,你偶阅此文。于是,“潘多拉”的魔盒打开了!没错,USB资源就是你打开新世界得钥匙,它能做哪些扩展呢?1.1  USB扩网口通用ARM处理器大多带两路网口,如果项目中有多路网路接口的需求,一般会选择在主板外部加交换机/路由器。当然,出于成本考虑,也可以将Switch芯片集成到ARM核心板或底板上,如KSZ9897、
    万象奥科 2024-12-03 10:24 68浏览
  • 学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习笔记&记录学习习笔记&记学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&
    youyeye 2024-11-30 14:30 78浏览
  • RDDI-DAP错误通常与调试接口相关,特别是在使用CMSIS-DAP协议进行嵌入式系统开发时。以下是一些可能的原因和解决方法: 1. 硬件连接问题:     检查调试器(如ST-Link)与目标板之间的连接是否牢固。     确保所有必要的引脚都已正确连接,没有松动或短路。 2. 电源问题:     确保目标板和调试器都有足够的电源供应。     检查电源电压是否符合目标板的规格要求。 3. 固件问题: &n
    丙丁先生 2024-12-01 17:37 100浏览
  • 当前,智能汽车产业迎来重大变局,随着人工智能、5G、大数据等新一代信息技术的迅猛发展,智能网联汽车正呈现强劲发展势头。11月26日,在2024紫光展锐全球合作伙伴大会汽车电子生态论坛上,紫光展锐与上汽海外出行联合发布搭载紫光展锐A7870的上汽海外MG量产车型,并发布A7710系列UWB数字钥匙解决方案平台,可应用于数字钥匙、活体检测、脚踢雷达、自动泊车等多种智能汽车场景。 联合发布量产车型,推动汽车智能化出海紫光展锐与上汽海外出行达成战略合作,联合发布搭载紫光展锐A7870的量产车型
    紫光展锐 2024-12-03 11:38 101浏览
  • 遇到部分串口工具不支持1500000波特率,这时候就需要进行修改,本文以触觉智能RK3562开发板修改系统波特率为115200为例,介绍瑞芯微方案主板Linux修改系统串口波特率教程。温馨提示:瑞芯微方案主板/开发板串口波特率只支持115200或1500000。修改Loader打印波特率查看对应芯片的MINIALL.ini确定要修改的bin文件#查看对应芯片的MINIALL.ini cat rkbin/RKBOOT/RK3562MINIALL.ini修改uart baudrate参数修改以下目
    Industio_触觉智能 2024-12-03 11:28 84浏览
  • 戴上XR眼镜去“追龙”是种什么体验?2024年11月30日,由上海自然博物馆(上海科技馆分馆)与三湘印象联合出品、三湘印象旗下观印象艺术发展有限公司(下简称“观印象”)承制的《又见恐龙》XR嘉年华在上海自然博物馆重磅开幕。该体验项目将于12月1日正式对公众开放,持续至2025年3月30日。双向奔赴,恐龙IP撞上元宇宙不久前,上海市经济和信息化委员会等部门联合印发了《上海市超高清视听产业发展行动方案》,特别提到“支持博物馆、主题乐园等场所推动超高清视听技术应用,丰富线下文旅消费体验”。作为上海自然
    电子与消费 2024-11-30 22:03 98浏览
  • TOF多区传感器: ND06   ND06是一款微型多区高集成度ToF测距传感器,其支持24个区域(6 x 4)同步测距,测距范围远达5m,具有测距范围广、精度高、测距稳定等特点。适用于投影仪的无感自动对焦和梯形校正、AIoT、手势识别、智能面板和智能灯具等多种场景。                 如果用ND06进行手势识别,只需要经过三个步骤: 第一步&
    esad0 2024-12-04 11:20 50浏览
  •         温度传感器的精度受哪些因素影响,要先看所用的温度传感器输出哪种信号,不同信号输出的温度传感器影响精度的因素也不同。        现在常用的温度传感器输出信号有以下几种:电阻信号、电流信号、电压信号、数字信号等。以输出电阻信号的温度传感器为例,还细分为正温度系数温度传感器和负温度系数温度传感器,常用的铂电阻PT100/1000温度传感器就是正温度系数,就是说随着温度的升高,输出的电阻值会增大。对于输出
    锦正茂科技 2024-12-03 11:50 106浏览
  • 11-29学习笔记11-29学习笔记习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习笔记&记录学习习笔记&记学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&学习学习笔记&记录学习学习笔记&记录学习学习笔记&记
    youyeye 2024-12-02 23:58 71浏览
  • 概述 说明(三)探讨的是比较器一般带有滞回(Hysteresis)功能,为了解决输入信号转换速率不够的问题。前文还提到,即便使能滞回(Hysteresis)功能,还是无法解决SiPM读出测试系统需要解决的问题。本文在说明(三)的基础上,继续探讨为SiPM读出测试系统寻求合适的模拟脉冲检出方案。前四代SiPM使用的高速比较器指标缺陷 由于前端模拟信号属于典型的指数脉冲,所以下降沿转换速率(Slew Rate)过慢,导致比较器检出出现不必要的问题。尽管比较器可以使能滞回(Hysteresis)模块功
    coyoo 2024-12-03 12:20 108浏览
  • 《高速PCB设计经验规则应用实践》+PCB绘制学习与验证读书首先看目录,我感兴趣的是这一节;作者在书中列举了一条经典规则,然后进行详细分析,通过公式推导图表列举说明了传统的这一规则是受到电容加工特点影响的,在使用了MLCC陶瓷电容后这一条规则已经不再实用了。图书还列举了高速PCB设计需要的专业工具和仿真软件,当然由于篇幅所限,只是介绍了一点点设计步骤;我最感兴趣的部分还是元件布局的经验规则,在这里列举如下:在这里,演示一下,我根据书本知识进行电机驱动的布局:这也算知行合一吧。对于布局书中有一句:
    wuyu2009 2024-11-30 20:30 122浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦