【Dlib人脸检测】1. HOG特征描述方法

2023-11-02 04:50

本文主要是介绍【Dlib人脸检测】1. HOG特征描述方法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

【 1. Harr级联人脸检测、Dlib人脸检测器 】

OpenCV中的Harr级联人脸检测算是人脸识别中早期的检测方法,现在Dlib库在业内开始流行。因为很大程度上是其使用的HOG-SVM人脸检测比OpenCVHarr级联人脸检测效果更好。
当然,现在两个库中也都集成了基于深度学习方法的人脸检测算法。

  • OpenCV中Harr级联人脸检测优缺点

优点:
几乎可以在CPU上实时工作;
架构简单;
可以检测不同比例的人脸。

缺点
会出现大量的把非人脸预测为人脸的情况;
不适用于非正面人脸图像;
不抗遮挡。

  • Dlib中HOG-SVM人脸检测级优缺点

优点:
CPU上最快的方法;
适用于正面和略微非正面的人脸;
模型很小;
在小的遮挡下仍可工作。

缺点:
不能检测小脸,因为它训练数据的最小人脸尺寸为80×80,但是用户可以用较小尺寸的人脸数据自己训练检测器;
边界框通常排除前额的一部分甚至下巴的一部分;
在严重遮挡下不能很好地工作;
不适用于侧面和极端非正面,如俯视或仰视。

【 2. HOG的定义】

  • HOG定义:

方向梯度直方图(Histogram of Oriented Gradient, HOG)是一种在计算机视觉和图像处理中用来进行物体检测的特征描述方法(特征描述方法:就是通过从图像中提取有用信息和丢弃无关信息来简化图像,并将信息运用于算法)。

  • HOG提取的图像信息:
  1. 特征描述方法从图像中提取有用信息
  1. 在图像中,物体的边缘和角落包含了关于物体形状的更多信息,也就是我们平时能看到的物体轮廓。如果能够提取出图像边缘和角落的信息,将非常有利于物体检测。
  1. 而对于图像的边缘和角落周围的梯度这个特征,变化幅度很大,所以在HOG特征描述方法中,使用梯度方向的分布(直方图)作为它的特征。

【 3. HOG算法的基本流程 】

  • HOG算法的基本流程的基本4步流程:
    ① 计算图像梯度;
    ② 计算Cell中的梯度直方图;
    ③ Block归一化;
    ④ 计算HOG特征。

1. 计算图像梯度

在HOG特征描述方法中,梯度方向的分布(直方图)被用作它的特征。

  • 图像梯度是什么 ?
  1. 图像是由一个个像素点组成的,可以将图像看成二维离散函数f(x,y)。
  2. 图像函数f(x,y)在点(x,y)的梯度G(x,y)是一个具有大小和方向的矢量,设Gx和 Gy分别表示水平 x 方向和垂直 y 方向的梯度.
  • 图像梯度公式:
    经典的图像梯度算法是考虑图像的每个像素的某个邻域内的灰度变化。
    图像梯度的计算公式:
    G x ( i , j ) = I ( i + 1 , j ) − I ( i , j ) G_x(i,j) = I(i+1,j) - I(i,j) Gx(i,j)=I(i+1,j)I(i,j)
    G y ( i , j ) = I ( i , j + 1 ) − I ( i , j ) G_y(i,j) = I(i,j+1) - I(i,j) Gy(i,j)=I(i,j+1)I(i,j)
    G ( i , j ) = G x ( i , j ) + G y ( i , j ) G(i,j) = G_x(i,j) + G_y(i,j) G(i,j)=Gx(i,j)+Gy(i,j)
    θ ( i , j ) = a r c t a n G x ( i , j ) G y ( i , j ) θ(i,j) = arctan \frac{G_x(i,j)} {G_y(i,j)} θ(i,j)=arctanGy(i,j)Gx(i,j)
    其中 I(i,j)表示 (i,j) 像素点处的图像的像素值, θ(i,j)表示 (i,j) 像素点梯度的角度。
  • OpenCV计算图像梯度
import cv2
import numpy as np
img = cv2.imread("picture.jpg")
img = np.float32(img) / 255.0#计算图像所有像素点的水平梯度,保存在sobelx中。1,0参数表示在x方向求一阶导数
gx = cv2.Sobel(img, cv2.CV_32F, 1, 0, ksize=1)#计算图像所有像素点的垂直梯度,保存在sobely中。0,1参数表示在y方向求一阶导数
gy = cv2.Sobel(img, cv2.CV_32F, 0, 1, ksize=1)#进而求得所有图像的梯度以及梯度角度
#其中magnitude表示梯度,angle表示magnitude对应的梯度的角度
magnitude, angle = cv2.cartToPolar(gx, gy, angleInDegrees=True)

2. 计算Cell中的梯度直方图

  1. 像素梯度分析的拓展: Cell
    由于分析每一个像素的梯度太过细节化了,如果能从更高的角度上观察图像片更能观察出图像的一些规律,而Cell就是在像素的更高的角度。
  1. Cell 和 9-bins直方图
    在OpenCV中一个Cell默认是8x8个像素,所以一个Cell中其实包含了8x8 = 64个梯度与梯度角度对,这些对最终都会映射到9-bins直方图,而9-bins直方图就是横坐标有9个点的直方图。
  1. 梯度的角度
    首先得说明的是,梯度的角度是介于0和180度之间,而不是0到360度,也就是说某个角度以及它的负数会由相同的数字表示。
    而在9-bin直方图中,横坐标上的点分别是 0, 20, 40 … 180,这些值就代表梯度的角度。
  1. 梯度映射到9-bin直方图
    我们上面说到梯度与梯度角度对最终都会映射到直方图中,那如何映射呢?举个简单的例子吧,现在有一个(5,55)对,即其梯度为5、梯度角度为55度,它位于[40度,60度]之间,那么它会映射到第3个bins,第3个bins的值会加上他的梯度,也就是加上5。
    如下图:
    在这里插入图片描述
    也就是说,梯度角度决定了映射的bins,梯度决定了映射的值。这样我们就可以求出每个cell的梯度直方图了。

3. Block 归一化

  • 目的:
    梯度对于图像的光照亮度是十分敏感的,一般需要对梯度做归一化处理以消除亮度变化的影响。
  • 方法:
    在HOG采取的方法是:把 Cell 组合成大的、空间上连通的区块(Blocks)。
    在OpenCV中,默认Block的大小为16x16个像素点,也就是2x2个Cell。
    如下图:
    在这里插入图片描述
  • 归一化的理解:
  1. 假设有一个向量v1,它的值为[128,64,32]。经过计算可得,该向量长度是: 12 8 2 + 6 4 2 + 3 2 2 = 146.64 \sqrt{128^2+64^2+32^2}=146.64 1282+642+322 =146.64
    将该向量的每个元素除以146.64,得到归一化向量[0.87,0.43,0.22]。
    .
  2. 同样的,如果将v1 x 2,能得到新向量v2[256,1268,64],对其归一化的结果仍然为[087,0.43,0.22],也就是说归一化会去除数值大小的影响
    .
  3. 如果我们对Block归一化处理,当光照强度变化大时,该区域的梯度值普遍会更大,从而减少了光照的影响。
    .
  4. 虽然我们可以以Cell为单位,对图片进行归一化处理,但更好的是在比Cell更大尺寸的Block上进行归一化。因为Block的像素点更多,受到光照的影响会更小。在一个16×16块中有将包含4个Cell,那么一个块中就可以连接形成一个长度为4x9=36的向量(1个Cell中包含9个Bins)。

4. 计算HOG特征

将所有的block归一化后得到的向量合起来就形成了一个HOG特征。

  • 为了计算一张图片的所有HOG特征,需要计算所有的Block。通过移动Block窗口的方式进行一 一计算,其过程如下图所示:
    在这里插入图片描述

【 4. 使用OpenCV计算HOG特征 】

上面我们详细的讲解了Hog特征描述方法的原理。现在我们可以借助OpenCV中封装好的方法来计算HOG特征。

  1. 首先,使用cv2.HOGDescriptor()函数声明HOG特征描述方法,代码如下:
hog = cv2.HOGDescriptor() #使用cv2.HOGDescriptor()函数声明HOG特征描述方法
  1. 然后计算加载的图像的HOG特征值,代码如下:
h = hog.compute(img) #计算加载的图像的HOG特征值
  • 完整的代码示例如下:
import cv2hog = cv2.HOGDescriptor()#使用cv2.HOGDescriptor()函数声明HOG特征描述方法img = cv2.imread("picture.jpg")# 读取图片feature = hog.compute(img)
print(feature)

在这里插入图片描述

这篇关于【Dlib人脸检测】1. HOG特征描述方法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/328246

相关文章

综合安防管理平台LntonAIServer视频监控汇聚抖动检测算法优势

LntonAIServer视频质量诊断功能中的抖动检测是一个专门针对视频稳定性进行分析的功能。抖动通常是指视频帧之间的不必要运动,这种运动可能是由于摄像机的移动、传输中的错误或编解码问题导致的。抖动检测对于确保视频内容的平滑性和观看体验至关重要。 优势 1. 提高图像质量 - 清晰度提升:减少抖动,提高图像的清晰度和细节表现力,使得监控画面更加真实可信。 - 细节增强:在低光条件下,抖

【C++】_list常用方法解析及模拟实现

相信自己的力量,只要对自己始终保持信心,尽自己最大努力去完成任何事,就算事情最终结果是失败了,努力了也不留遗憾。💓💓💓 目录   ✨说在前面 🍋知识点一:什么是list? •🌰1.list的定义 •🌰2.list的基本特性 •🌰3.常用接口介绍 🍋知识点二:list常用接口 •🌰1.默认成员函数 🔥构造函数(⭐) 🔥析构函数 •🌰2.list对象

浅谈主机加固,六种有效的主机加固方法

在数字化时代,数据的价值不言而喻,但随之而来的安全威胁也日益严峻。从勒索病毒到内部泄露,企业的数据安全面临着前所未有的挑战。为了应对这些挑战,一种全新的主机加固解决方案应运而生。 MCK主机加固解决方案,采用先进的安全容器中间件技术,构建起一套内核级的纵深立体防护体系。这一体系突破了传统安全防护的局限,即使在管理员权限被恶意利用的情况下,也能确保服务器的安全稳定运行。 普适主机加固措施:

webm怎么转换成mp4?这几种方法超多人在用!

webm怎么转换成mp4?WebM作为一种新兴的视频编码格式,近年来逐渐进入大众视野,其背后承载着诸多优势,但同时也伴随着不容忽视的局限性,首要挑战在于其兼容性边界,尽管WebM已广泛适应于众多网站与软件平台,但在特定应用环境或老旧设备上,其兼容难题依旧凸显,为用户体验带来不便,再者,WebM格式的非普适性也体现在编辑流程上,由于它并非行业内的通用标准,编辑过程中可能会遭遇格式不兼容的障碍,导致操

透彻!驯服大型语言模型(LLMs)的五种方法,及具体方法选择思路

引言 随着时间的发展,大型语言模型不再停留在演示阶段而是逐步面向生产系统的应用,随着人们期望的不断增加,目标也发生了巨大的变化。在短短的几个月的时间里,人们对大模型的认识已经从对其zero-shot能力感到惊讶,转变为考虑改进模型质量、提高模型可用性。 「大语言模型(LLMs)其实就是利用高容量的模型架构(例如Transformer)对海量的、多种多样的数据分布进行建模得到,它包含了大量的先验

烟火目标检测数据集 7800张 烟火检测 带标注 voc yolo

一个包含7800张带标注图像的数据集,专门用于烟火目标检测,是一个非常有价值的资源,尤其对于那些致力于公共安全、事件管理和烟花表演监控等领域的人士而言。下面是对此数据集的一个详细介绍: 数据集名称:烟火目标检测数据集 数据集规模: 图片数量:7800张类别:主要包含烟火类目标,可能还包括其他相关类别,如烟火发射装置、背景等。格式:图像文件通常为JPEG或PNG格式;标注文件可能为X

【北交大信息所AI-Max2】使用方法

BJTU信息所集群AI_MAX2使用方法 使用的前提是预约到相应的算力卡,拥有登录权限的账号密码,一般为导师组共用一个。 有浏览器、ssh工具就可以。 1.新建集群Terminal 浏览器登陆10.126.62.75 (如果是1集群把75改成66) 交互式开发 执行器选Terminal 密码随便设一个(需记住) 工作空间:私有数据、全部文件 加速器选GeForce_RTX_2080_Ti

基于 YOLOv5 的积水检测系统:打造高效智能的智慧城市应用

在城市发展中,积水问题日益严重,特别是在大雨过后,积水往往会影响交通甚至威胁人们的安全。通过现代计算机视觉技术,我们能够智能化地检测和识别积水区域,减少潜在危险。本文将介绍如何使用 YOLOv5 和 PyQt5 搭建一个积水检测系统,结合深度学习和直观的图形界面,为用户提供高效的解决方案。 源码地址: PyQt5+YoloV5 实现积水检测系统 预览: 项目背景

JavaFX应用更新检测功能(在线自动更新方案)

JavaFX开发的桌面应用属于C端,一般来说需要版本检测和自动更新功能,这里记录一下一种版本检测和自动更新的方法。 1. 整体方案 JavaFX.应用版本检测、自动更新主要涉及一下步骤: 读取本地应用版本拉取远程版本并比较两个版本如果需要升级,那么拉取更新历史弹出升级控制窗口用户选择升级时,拉取升级包解压,重启应用用户选择忽略时,本地版本标志为忽略版本用户选择取消时,隐藏升级控制窗口 2.

【VUE】跨域问题的概念,以及解决方法。

目录 1.跨域概念 2.解决方法 2.1 配置网络请求代理 2.2 使用@CrossOrigin 注解 2.3 通过配置文件实现跨域 2.4 添加 CorsWebFilter 来解决跨域问题 1.跨域概念 跨域问题是由于浏览器实施了同源策略,该策略要求请求的域名、协议和端口必须与提供资源的服务相同。如果不相同,则需要服务器显式地允许这种跨域请求。一般在springbo