----追光逐电 光赢未来----
使用OpenCV,你几乎可以完成你能想到的每种计算机视觉任务。现实生活中的问题要求同时使用许多计算机视觉算法和模块来获得所需的结果。因此,你只需了解要用哪些OpenCV模块和函数来获得你想要的东西。
让我们来看看OpenCV中可以开箱即用的功能。
OpenCV的最大优点之一是它提供了许多内置基元来处理与图像处理和计算机视觉相关的操作。如果你必须从零开始编程,就必须定义Image、Point、Rectangle等。这些几乎是任何计算机视觉算法的基础。
OpenCV自带所有这些基本结构,它们包含在核心模块中。另一个优点是这些结构已经针对速度和内存进行了优化,因此你不必担心其实现细节。
imgcodecs模块可以处理图像文件的读取和写入。当你对输入图像进行操作并创建输出图像时,可以使用简单的命令将其另存为.jpg或.png文件。
使用摄像机时,你将会处理大量的视频文件。videoio模块可以处理与视频文件的输入和输出相关的所有操作。你可以轻松地从网络摄像头捕获视频,或以多种不同格式读取视频文件。你甚至可以通过设置诸如每秒帧数、帧大小等属性来将很多帧保存为视频文件。
在编写计算机视觉算法时,会有很多基本的图像处理操作,你将反复使用它们。大多数这些函数都在imgproc模块中。你可以执行诸如图像过滤、形态学操作、几何变换、颜色转换、图像绘制、直方图、形状分析、运动分析、特征检测等操作。
让我们来看看图1-3。
右图是左侧图像的旋转版本,我们在OpenCV中用一行代码就可以实现这种转换。
还有另一个名为ximgproc的模块,它包含高级图像处理算法,可以用于诸如结构化森林的边缘检测、域变换滤波器、自适应流形滤波器等处理。
OpenCV提供了一个名为highgui的模块,可用于处理所有高级用户界面操作。假设你正在解决一个问题,并且想要在继续下一步之前检查图像的外观,则可利用该模块具有的创建窗口以显示图像和视频的功能。
它有一个等待功能,可以等你按下键盘上的一个键才进入下一步。还有一个可以检测鼠标事件的功能,在开发交互式应用程序时非常有用。
使用这些功能,你可以在那些输入窗口上绘制矩形,然后根据所选区域进行处理,以图1-4为例。
如你所见,我们在窗口上画了一个绿色矩形。一旦得到这个矩形的坐标,就可以单独操作该区域。
视频分析包括诸如分析视频中连续帧之间的运动、跟踪视频中的不同目标、创建视频监控模型等任务。OpenCV提供了一个名为video的模块,可以处理所有这些任务。
还有一个名为videostab的模块,用来处理视频稳定的问题。视频稳定非常重要,因为当你通过手持摄像机拍摄视频时,通常会有很多抖动需要纠正。所有的现代设备都会使用视频稳定功能,以便在将视频呈现给最终用户之前对其进行处理。
3D重建是计算机视觉中的一个重要课题。给定一组2D图像,我们可以使用相关算法重建3D场景。在calib3d模块中,OpenCV提供的算法可以找到这些2D图像中各种对象之间的关系,并计算其3D位置。
该模块还可以处理摄像机校准,这对于估计摄像机的参数至关重要。这些参数定义了摄像机如何看到它前面的场景。我们需要知道这些参数来设计算法,否则我们可能会得到意想不到的结果。
请看图1-5。
正如我们在这里看到的,相同的对象从多个位置被捕获。我们的工作是使用这些2D图像重建原始对象。
OpenCV自带名为objdetect和xobjdetect的模块,它们提供了设计对象检测器的框架,你可以使用它们来开发任何对象的探测器,比如太阳镜、靴子等。
形状的概念在计算机视觉中至关重要。我们通过识别图像中各种不同的形状来分析视觉数据。实际上,这是许多算法中的重要步骤。
假设你正在尝试识别图像中的特定徽标。你知道它可以按各种形状、方向和大小呈现。作为起步的一个好方法是量化对象的形状特征。
shape模块为提取不同形状、测量它们之间的相似性、转换对象形状等操作提供了所有算法。
人脸识别是指识别给定图像中的人物。这与人脸检测不同,在人脸检测中,只需要识别给定图像中人脸的位置。
如果你想建立一个可以识别相机前面的人的实用的生物识别系统,首先需要运行一个人脸检测器来识别人脸的位置,然后运行一个单独的人脸识别器来识别该人是谁。有一个名为face的OpenCV模块用于处理人脸识别。
正如我们之前讨论的那样,计算机视觉试图按照人类感知视觉数据的方式对算法进行建模。因此,在图像中找到显著的区域和对象将是有帮助的,这可以帮助我们处理不同的应用,例如目标识别、目标检测和跟踪等。一个名为saliency的模块是专门为此目的而设计的。它提供的算法可以检测静态图像和视频中的显著区域。
有越来越多的设备能够捕获我们周围对象的3D结构,这些设备能够捕获深度信息以及常规的2D彩色图像。因此,构建可以理解和处理3D对象的算法对我们来说非常重要。
Kinect是捕获深度信息和视觉数据的一个很好的设备例子,它现在能够识别输入的3D对象,并将其与数据库中的模型匹配。如果我们有一个可以识别和定位对象的系统,那么它就可以用于许多不同的应用程序。
一个名为surface_matching的模块包含用于3D对象识别的算法,以及使用3D特征的姿势估计算法。
深度学习对计算机视觉和图像识别有很大影响,并且比其他机器学习和人工智能算法具有更高的准确度。深度学习不是一个新概念;它在1986年左右被提出,但在2012年左右有了革命性进步,当时新的GPU硬件针对并行计算和卷积神经网络(Convolutional Neural Network,简称CNN)实现进行了优化,加上其他技术,使得在合理的时间内训练复杂的神经网络架构成为可能。
深度学习可以应用于多种用例,例如图像识别、目标检测、语音识别和自然语言处理。从版本3.4开始,OpenCV一直在实现深度学习算法,在最新版本中,添加了诸如TensorFlow和Caffe等多个重要框架的导入器。
申明:感谢原创作者的辛勤付出。本号转载的文章均会在文中注明,若遇到版权问题请联系我们处理。
----与智者为伍 为创新赋能----
联系邮箱:uestcwxd@126.com
QQ:493826566