【光电智造】计算机视觉新高度,机器摄像头瞟一眼就记住所有细节,远超碳基生命视觉系统以及记忆系统

今日光电 2024-03-27 18:01

今日光电

     有人说,20世纪是电的世纪,21世纪是光的世纪;知光解电,再小的个体都可以被赋能。追光逐电,光赢未来...欢迎来到今日光电!




----追光逐电 光赢未来----

由麻省理工学院CSAIL研究人员开发的FeatUp,提高了任何深度网络或计算机视觉系统视觉基础的分辨率。

想象一下,你瞥了一眼繁忙的街道几秒钟,然后试图从记忆中勾画出你所看到的场景。大多数人可以画出汽车、人和人行横道等主要物体的大致位置,但几乎没有人能以像素级的精确度画出每一个细节。对于大多数现代计算机视觉算法来说也是如此:它们擅长捕捉场景的高级细节,但在处理信息时会丢失细致的细节。
现在,麻省理工学院的研究人员创建了一个名为“FeatUp”的系统,允许算法同时捕捉场景的高层次和低层次细节——几乎就像给计算机视觉做了激光眼睛手术。
当计算机通过查看图像和视频学习“看”时,它们通过所谓的“特征”建立对场景中内容的“想法”。为了创建这些特征,深度网络和视觉基础模型将图像分解成一格格的小方块,并将这些方块作为一个组进行处理,以确定照片中正在发生什么。每个小方块通常由16到32个像素组成,因此这些算法的分辨率远小于它们处理的图像。在尝试总结和理解照片时,算法会丢失大量的像素清晰度。
FeatUp算法可以阻止这种信息损失,并提高任何深度网络的分辨率,而不会影响速度或质量。这允许研究人员快速轻松地提高任何新的或现有算法的分辨率。例如,尝试解释肺癌检测算法的预测,目标是定位肿瘤。在使用类似类激活映射(CAM)方法解释算法之前应用FeatUp,可以得到一个明显更详细(16-32倍)的视图,根据模型可能位于肿瘤的位置。
FeatUp不仅帮助从业者理解他们的模型,还可以改善各种不同的任务,如对象检测、语义分割(将图像中的像素与对象标签相对应)和深度估计。它通过提供更准确的高分辨率特征,这对于构建从自动驾驶到医学成像等视觉应用至关重要,从而实现了这一点。
“所有计算机视觉的本质在于这些深度学习架构深处涌现的深层、智能特征。现代算法的一大挑战是它们将大图像简化为非常小的‘智能’特征网格,获得智能洞察但丢失了细节,”麻省理工学院电气工程与计算机科学系的博士生、计算机科学与人工智能实验室(CSAIL)附属成员、该项目论文的共同首席作者马克·汉密尔顿说。“FeatUp帮助实现了两全其美:具有原始图像分辨率的高度智能表示。这些高分辨率特征显著提升了计算机视觉任务的性能,从增强对象检测和改进深度预测,到通过高分辨率分析提供网络决策过程的更深入理解。”

分辨率复兴

随着这些大型AI模型变得越来越普遍,解释它们在做什么、在看什么、在想什么的需求也在增加。
但FeatUp是如何发现这些细致的细节的呢?奇怪的是,秘密在于轻微地调整图像。
特别是,FeatUp对图像进行轻微调整(比如将图像向左或向右移动几个像素),并观察算法对这些轻微图像移动的响应。这产生了数百个略有不同的深度特征图,可以组合成一套清晰的、高分辨率的深度特征集。“我们想象一些高分辨率特征的存在,当我们摆动它们并模糊它们时,它们将与所有原始、较低分辨率特征匹配。我们的目标是学习如何将低分辨率特征精炼成高分辨率特征,通过这个‘游戏’让我们知道我们做得如何,”汉密尔顿说。这种方法类似于算法如何从多张2D图像创建3D模型,确保预测的3D对象与用于创建它的所有2D照片匹配。在FeatUp的情况下,它们预测与通过晃动原始图像形成的所有低分辨率特征图一致的高分辨率特征图。
该团队指出,PyTorch中可用的标准工具无法满足他们的需求,并在寻求快速高效解决方案的过程中引入了一种新型的深度网络层。他们的自定义层,一种特殊的联合双边上采样操作,比PyTorch中的简单实现高出100倍以上。该团队还展示了这个新层如何改善包括语义分割和深度预测在内的各种不同算法。这个层提高了网络处理和理解高分辨率细节的能力,给任何使用它的算法带来了实质性的性能提升。
“另一个应用是所谓的小物体检索,我们的算法允许精确定位物体。例如,即使在杂乱的道路场景中,通过FeatUp丰富的算法也可以看到像交通锥、反光器、灯和坑洞这样的小物体,而它们的低分辨率对应物则失败了。这证明了它将粗糙特征增强为精细信号的能力,”加州大学伯克利分校的博士生、新FeatUp论文的另一位共同首席作者斯蒂芬妮·傅说。“这对于时间敏感的任务特别关键,比如在拥挤的高速公路上准确指出交通标志。这不仅可以通过将广泛的猜测转化为精确的定位来提高这些任务的准确性,还可能使这些系统更可靠、可解释和值得信赖。”

接下来是什么?

关于未来的愿景,团队强调FeatUp在研究界和更广泛的领域内的潜在广泛采用,类似于数据增强实践。“目标是使这种方法成为深度学习中的基本工具,丰富模型以更细致地感知世界,而不会带来传统高分辨率处理的计算低效率,”傅说。
“FeatUp代表着向着使视觉表示真正有用的方向迈出的美妙进步,通过以全图像分辨率产生它们,”康奈尔大学计算机科学教授诺亚·斯纳夫利说,他没有参与这项研究。“在过去几年中,学习到的视觉表示变得非常好,但它们几乎总是以非常低的分辨率产生——你可能输入一个漂亮的全分辨率照片,然后得到一个微小的、邮票大小的特征网格。如果你想在产生全分辨率输出的应用中使用这些特征,这就是一个问题。FeatUp以一种创造性的方式解决了这个问题,将超分辨率中的经典思想与现代学习方法结合起来,产生了美丽的、高分辨率的特征图。”
“我们希望这个简单的想法可以有广泛的应用。它提供了我们之前认为只能是低分辨率的图像分析的高分辨率版本,”高级作者、麻省理工学院电气工程与计算机科学教授、CSAIL成员威廉·T·弗里曼说。
领头作者傅和汉密尔顿由麻省理工学院CSAIL的当前或前附属成员、博士生劳拉·布兰特SM '21、阿克塞尔·费尔德曼SM '21以及周通·张SM '21、博士 '22共同完成。他们的研究部分由国家科学基金会研究生奖学金、国家科学基金会和国家情报总监办公室、美国空军研究实验室以及美国空军人工智能加速器资助。该团队将在5月的国际学习表示会议上展示他们的工作。
来源:新机器视觉



申明:感谢原创作者的辛勤付出。本号转载的文章均会在文中注明,若遇到版权问题请联系我们处理。


 

----与智者为伍 为创新赋能----


【说明】欢迎企业和个人洽谈合作,投稿发文。欢迎联系我们
诚招运营合伙人 ,对新媒体感兴趣,对光电产业和行业感兴趣。非常有意者通过以下方式联我们!条件待遇面谈
投稿丨合作丨咨询

联系邮箱:uestcwxd@126.com

QQ:493826566



评论
  • 光伏逆变器是一种高效的能量转换设备,它能够将光伏太阳能板(PV)产生的不稳定的直流电压转换成与市电频率同步的交流电。这种转换后的电能不仅可以回馈至商用输电网络,还能供独立电网系统使用。光伏逆变器在商业光伏储能电站和家庭独立储能系统等应用领域中得到了广泛的应用。光耦合器,以其高速信号传输、出色的共模抑制比以及单向信号传输和光电隔离的特性,在光伏逆变器中扮演着至关重要的角色。它确保了系统的安全隔离、干扰的有效隔离以及通信信号的精准传输。光耦合器的使用不仅提高了系统的稳定性和安全性,而且由于其低功耗的
    晶台光耦 2024-12-02 10:40 120浏览
  • 遇到部分串口工具不支持1500000波特率,这时候就需要进行修改,本文以触觉智能RK3562开发板修改系统波特率为115200为例,介绍瑞芯微方案主板Linux修改系统串口波特率教程。温馨提示:瑞芯微方案主板/开发板串口波特率只支持115200或1500000。修改Loader打印波特率查看对应芯片的MINIALL.ini确定要修改的bin文件#查看对应芯片的MINIALL.ini cat rkbin/RKBOOT/RK3562MINIALL.ini修改uart baudrate参数修改以下目
    Industio_触觉智能 2024-12-03 11:28 87浏览
  • 11-29学习笔记11-29学习笔记习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习笔记&记录学习习笔记&记学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&学习学习笔记&记录学习学习笔记&记录学习学习笔记&记
    youyeye 2024-12-02 23:58 71浏览
  • 当前,智能汽车产业迎来重大变局,随着人工智能、5G、大数据等新一代信息技术的迅猛发展,智能网联汽车正呈现强劲发展势头。11月26日,在2024紫光展锐全球合作伙伴大会汽车电子生态论坛上,紫光展锐与上汽海外出行联合发布搭载紫光展锐A7870的上汽海外MG量产车型,并发布A7710系列UWB数字钥匙解决方案平台,可应用于数字钥匙、活体检测、脚踢雷达、自动泊车等多种智能汽车场景。 联合发布量产车型,推动汽车智能化出海紫光展锐与上汽海外出行达成战略合作,联合发布搭载紫光展锐A7870的量产车型
    紫光展锐 2024-12-03 11:38 101浏览
  • RDDI-DAP错误通常与调试接口相关,特别是在使用CMSIS-DAP协议进行嵌入式系统开发时。以下是一些可能的原因和解决方法: 1. 硬件连接问题:     检查调试器(如ST-Link)与目标板之间的连接是否牢固。     确保所有必要的引脚都已正确连接,没有松动或短路。 2. 电源问题:     确保目标板和调试器都有足够的电源供应。     检查电源电压是否符合目标板的规格要求。 3. 固件问题: &n
    丙丁先生 2024-12-01 17:37 100浏览
  • 最近几年,新能源汽车愈发受到消费者的青睐,其销量也是一路走高。据中汽协公布的数据显示,2024年10月,新能源汽车产销分别完成146.3万辆和143万辆,同比分别增长48%和49.6%。而结合各家新能源车企所公布的销量数据来看,比亚迪再度夺得了销冠宝座,其10月新能源汽车销量达到了502657辆,同比增长66.53%。众所周知,比亚迪是新能源汽车领域的重要参与者,其一举一动向来为外界所关注。日前,比亚迪汽车旗下品牌方程豹汽车推出了新车方程豹豹8,该款车型一上市就迅速吸引了消费者的目光,成为SUV
    刘旷 2024-12-02 09:32 119浏览
  • TOF多区传感器: ND06   ND06是一款微型多区高集成度ToF测距传感器,其支持24个区域(6 x 4)同步测距,测距范围远达5m,具有测距范围广、精度高、测距稳定等特点。适用于投影仪的无感自动对焦和梯形校正、AIoT、手势识别、智能面板和智能灯具等多种场景。                 如果用ND06进行手势识别,只需要经过三个步骤: 第一步&
    esad0 2024-12-04 11:20 50浏览
  • 戴上XR眼镜去“追龙”是种什么体验?2024年11月30日,由上海自然博物馆(上海科技馆分馆)与三湘印象联合出品、三湘印象旗下观印象艺术发展有限公司(下简称“观印象”)承制的《又见恐龙》XR嘉年华在上海自然博物馆重磅开幕。该体验项目将于12月1日正式对公众开放,持续至2025年3月30日。双向奔赴,恐龙IP撞上元宇宙不久前,上海市经济和信息化委员会等部门联合印发了《上海市超高清视听产业发展行动方案》,特别提到“支持博物馆、主题乐园等场所推动超高清视听技术应用,丰富线下文旅消费体验”。作为上海自然
    电子与消费 2024-11-30 22:03 98浏览
  • 概述 说明(三)探讨的是比较器一般带有滞回(Hysteresis)功能,为了解决输入信号转换速率不够的问题。前文还提到,即便使能滞回(Hysteresis)功能,还是无法解决SiPM读出测试系统需要解决的问题。本文在说明(三)的基础上,继续探讨为SiPM读出测试系统寻求合适的模拟脉冲检出方案。前四代SiPM使用的高速比较器指标缺陷 由于前端模拟信号属于典型的指数脉冲,所以下降沿转换速率(Slew Rate)过慢,导致比较器检出出现不必要的问题。尽管比较器可以使能滞回(Hysteresis)模块功
    coyoo 2024-12-03 12:20 111浏览
  • 《高速PCB设计经验规则应用实践》+PCB绘制学习与验证读书首先看目录,我感兴趣的是这一节;作者在书中列举了一条经典规则,然后进行详细分析,通过公式推导图表列举说明了传统的这一规则是受到电容加工特点影响的,在使用了MLCC陶瓷电容后这一条规则已经不再实用了。图书还列举了高速PCB设计需要的专业工具和仿真软件,当然由于篇幅所限,只是介绍了一点点设计步骤;我最感兴趣的部分还是元件布局的经验规则,在这里列举如下:在这里,演示一下,我根据书本知识进行电机驱动的布局:这也算知行合一吧。对于布局书中有一句:
    wuyu2009 2024-11-30 20:30 124浏览
  •         温度传感器的精度受哪些因素影响,要先看所用的温度传感器输出哪种信号,不同信号输出的温度传感器影响精度的因素也不同。        现在常用的温度传感器输出信号有以下几种:电阻信号、电流信号、电压信号、数字信号等。以输出电阻信号的温度传感器为例,还细分为正温度系数温度传感器和负温度系数温度传感器,常用的铂电阻PT100/1000温度传感器就是正温度系数,就是说随着温度的升高,输出的电阻值会增大。对于输出
    锦正茂科技 2024-12-03 11:50 109浏览
  • 作为优秀工程师的你,已身经百战、阅板无数!请先醒醒,新的项目来了,这是一个既要、又要、还要的产品需求,ARM核心板中一个处理器怎么能实现这么丰富的外围接口?踌躇之际,你偶阅此文。于是,“潘多拉”的魔盒打开了!没错,USB资源就是你打开新世界得钥匙,它能做哪些扩展呢?1.1  USB扩网口通用ARM处理器大多带两路网口,如果项目中有多路网路接口的需求,一般会选择在主板外部加交换机/路由器。当然,出于成本考虑,也可以将Switch芯片集成到ARM核心板或底板上,如KSZ9897、
    万象奥科 2024-12-03 10:24 68浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦