KCF高速跟踪详解

2024-05-10 07:58
文章标签 详解 跟踪 高速 kcf

本文主要是介绍KCF高速跟踪详解,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

Henriques, João F., et al. “High-speed tracking with kernelized 
correlation filters.” Pattern Analysis and Machine Intelligence, IEEE 
Transactions on 37.3 (2015): 583-596.

本文的跟踪方法效果甚好,速度奇高,思想和实现均十分简洁。其中利用循环矩阵进行快速计算的方法尤其值得学习。另外,作者在主页上十分慷慨地给出了各种语言的实现代码。 
本文详细推导论文中的一系列步骤,包括论文中未能阐明的部分。请务必先参看这篇简介循环矩阵性质的博客。

思想

一般化的跟踪问题可以分解成如下几步: 
1. 在 It 帧中,在当前位置 pt 附近采样,训练一个回归器。这个回归器能计算一个小窗口采样的响应。 
2. 在 It+1 帧中,在前一帧位置 pt 附近采样,用前述回归器判断每个采样的响应。 
3. 响应最强的采样作为本帧位置 pt+1

循环矩阵表示图像块

在图像中,循环位移操作可以用来近似采样窗口的位移。 
这里写图片描述 
训练时,围绕着当前位置进行的一系列位移采样可以用二维分块循环矩阵 X 表示,第ij块表示原始图像下移i行右移j列的结果。类似地,测试时,前一帧结果附近的一系列位移采样也可以用 X 表示。 
这里写图片描述 
这样的 X 可以利用傅里叶变换快速完成许多线性运算。

线性回归训练提速

此部分频繁用到了循环矩阵的各类性质,请参看这篇博客。 
线性回归的最小二乘方法解为: 

w=(XHX+λI)1XHy

根据循环矩阵乘法性质, XHX 的特征值为 x^x^ I 本身就是一个循环矩阵,其生成向量为 [1,0,0...0] ,这个生成向量的傅里叶变换为全1向量,记为 δ 。 

w=(Fdiag(x^x^)FH+λFdiag(δ)FH)1XHy

=(Fdiag(x^x^+λδ)FH)1XHy

根据循环矩阵求逆性质,可以把矩阵求逆转换为特征值求逆。 

w=Fdiag(1x^x^+λδ)FHXHy

w=Fdiag(1x^x^+λδ)FHFdiag(x^)FHy

利用 F 的酉矩阵性质消元: 

w=Fdiag(x^x^x^+λδ)FHy

分号表示用1进行对位相除。 
反用对角化性质: Fdiag(y)FH=C(F1(y)) ,上式的前三项还是一个循环矩阵。 

w=C(F1(x^x^x^+λδ))y

利用循环矩阵卷积性质 F(C(x)y)=x^y^ : 

F(w)=(x^x^x^+λδ)F(y)

由于 x^x^ 的每个元素都是实数,所以共轭不变:

F(w)=x^x^x^+λδF(y)=x^y^x^x^+λδ

论文中,最后这一步推导的分子部分写成 x^y^ ,是错误的。但代码中没有涉及。

线性回归系数 ω 可以通过向量的傅里叶变换和对位乘法计算得到。

核回归训练提速

不熟悉核方法的同学可以参看这篇博客的简单说明。核回归方法的回归式为: 

f(z)=αTκ(z)

其中 κ(z) 表示测试样本 z 和所有训练样本的核函数。参数有闭式解: 
α=(K+λI)1y

K 为所有训练样本的核相关矩阵: Kij=κ(xi,xj) 。如果核函数选择得当,使得 x 内部元素顺序更换不影响核函数取值,则可以保证 K 也是循环矩阵。以下核都满足这样的条件: 
这里写图片描述

设核相关矩阵的生成向量是 k 。推导和之前线性回归的套路非常类似: 

α=(Fdiag(k^)FH+Fdiag(λδ)FH)1y=(Fdiag(k^+λδ)FH)1y

=Fdiag(1k^+λδ)FHy=C(F1(1k^+λδ))y

利用循环矩阵卷积性质 F(C(x)y)=x^y^ : 

α^=(1k^+λδ)y^

这里 k 是核相关矩阵的第一行,表示原始生成向量 x0 和移位了 i 的向量 xi 的核函数。考察其处于对称位置上的两个元素: 
ki=κ(x0,xi),kNi=κ(x0,xNi)

两者都是同一个向量和自身位移结果进行运算。因为所有涉及到的核函数都只和位移的绝对值有关,所以 ki=kNi ,即 k 是对称向量。

举例: x0=[1,2,3,4] x1=[4,1,2,3] x3=[2,3,4,1] 。使用多项式核 κ(x,y)=xTy ,容易验证 κ(x0,x1)=κ(x0,x3)

对称向量的傅里叶变换为实数,有:

α^=(1k^+λδ)y^=y^k^+λδ

论文中,利用 k 的对称性消除共轭的步骤没有提及。

线性回归系数 α 可以通过向量的傅里叶变换和对位乘法计算得到。

核回归检测提速

所有待检测样本和所有训练样本的核相关矩阵为 K ,每一列对应一个待测样本。可以一次计算所有样本的响应( N×1 向量):

y=KTα

利用循环矩阵的转置性质性质, C(k) 的特征值为 k^ : 

y=C(k)Tα=C(k^)α=kα

利用循环矩阵的卷积性质: 

y=(k)α=kα

两边傅里叶变换: 

y^=k^α^

论文中,利用转置消除共轭的步骤没有提及。

所有侯选块的检测响应可以通过向量的傅里叶变换和对位乘法计算得到。

核相关矩阵计算提速

无论训练还是检测,都需要计算核相关矩阵 K 的生成向量 k 。除了直接计算每一个核函数,在某些特定的核函数下可以进一步加速。

多项式核

κ(x,y)=f(xTy)

其中 f 为多项式函数。写成矩阵形式: 

K=f(XTY)

f 在矩阵的每个元素上单独进行。根据循环矩阵性质, XTY 也是一个循环矩阵,其生成向量为 F1(y^x^) 。所以核相关矩阵的生成向量为: 

k=f(F1(y^x^))

RBF核

κ(x,y)=f(||xy||2)

其中 f 是线性函数。简单展开: 
κ(x,y)=f(||xy||2)=f(||x||2+||y||2+2xTy)

由于 X 中的所有 x 都通过循环移位获得,故 ||x||2 对于所有 x 是常数,同理 ||y||2 也是。所以核相关矩阵的生成向量为: 
k=f(||x||2+||y||2+F1(y^x^))

其他核

有一些核函数,虽然能保证 K 是循环矩阵,但无法直接拆解出其特征值,快速得到生成向量。比如Hellinger核: ixiyi ,Intersection核: imin(xi,yi)

多通道

在多通道情况下(例如使用了HOG特征),生成向量 x 变成 M×L ,其中 M 是样本像素数, L 是特征维度。在上述所有计算中,需要更改的只有向量的内积: 

xTy=l(xl)Tyl

注:非常感谢GX1415926535和大家的帮助,发现原文一处错误。(21)式中不应有转置,应为: 

f(z)=Kzα

这篇关于KCF高速跟踪详解的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/975881

相关文章

Spring Security基于数据库验证流程详解

Spring Security 校验流程图 相关解释说明(认真看哦) AbstractAuthenticationProcessingFilter 抽象类 /*** 调用 #requiresAuthentication(HttpServletRequest, HttpServletResponse) 决定是否需要进行验证操作。* 如果需要验证,则会调用 #attemptAuthentica

OpenHarmony鸿蒙开发( Beta5.0)无感配网详解

1、简介 无感配网是指在设备联网过程中无需输入热点相关账号信息,即可快速实现设备配网,是一种兼顾高效性、可靠性和安全性的配网方式。 2、配网原理 2.1 通信原理 手机和智能设备之间的信息传递,利用特有的NAN协议实现。利用手机和智能设备之间的WiFi 感知订阅、发布能力,实现了数字管家应用和设备之间的发现。在完成设备间的认证和响应后,即可发送相关配网数据。同时还支持与常规Sof

6.1.数据结构-c/c++堆详解下篇(堆排序,TopK问题)

上篇:6.1.数据结构-c/c++模拟实现堆上篇(向下,上调整算法,建堆,增删数据)-CSDN博客 本章重点 1.使用堆来完成堆排序 2.使用堆解决TopK问题 目录 一.堆排序 1.1 思路 1.2 代码 1.3 简单测试 二.TopK问题 2.1 思路(求最小): 2.2 C语言代码(手写堆) 2.3 C++代码(使用优先级队列 priority_queue)

K8S(Kubernetes)开源的容器编排平台安装步骤详解

K8S(Kubernetes)是一个开源的容器编排平台,用于自动化部署、扩展和管理容器化应用程序。以下是K8S容器编排平台的安装步骤、使用方式及特点的概述: 安装步骤: 安装Docker:K8S需要基于Docker来运行容器化应用程序。首先要在所有节点上安装Docker引擎。 安装Kubernetes Master:在集群中选择一台主机作为Master节点,安装K8S的控制平面组件,如AP

嵌入式Openharmony系统构建与启动详解

大家好,今天主要给大家分享一下,如何构建Openharmony子系统以及系统的启动过程分解。 第一:OpenHarmony系统构建      首先熟悉一下,构建系统是一种自动化处理工具的集合,通过将源代码文件进行一系列处理,最终生成和用户可以使用的目标文件。这里的目标文件包括静态链接库文件、动态链接库文件、可执行文件、脚本文件、配置文件等。      我们在编写hellowor

LabVIEW FIFO详解

在LabVIEW的FPGA开发中,FIFO(先入先出队列)是常用的数据传输机制。通过配置FIFO的属性,工程师可以在FPGA和主机之间,或不同FPGA VIs之间进行高效的数据传输。根据具体需求,FIFO有多种类型与实现方式,包括目标范围内FIFO(Target-Scoped)、DMA FIFO以及点对点流(Peer-to-Peer)。 FIFO类型 **目标范围FIFO(Target-Sc

019、JOptionPane类的常用静态方法详解

目录 JOptionPane类的常用静态方法详解 1. showInputDialog()方法 1.1基本用法 1.2带有默认值的输入框 1.3带有选项的输入对话框 1.4自定义图标的输入对话框 2. showConfirmDialog()方法 2.1基本用法 2.2自定义按钮和图标 2.3带有自定义组件的确认对话框 3. showMessageDialog()方法 3.1

脏页的标记方式详解

脏页的标记方式 一、引言 在数据库系统中,脏页是指那些被修改过但还未写入磁盘的数据页。为了有效地管理这些脏页并确保数据的一致性,数据库需要对脏页进行标记。了解脏页的标记方式对于理解数据库的内部工作机制和优化性能至关重要。 二、脏页产生的过程 当数据库中的数据被修改时,这些修改首先会在内存中的缓冲池(Buffer Pool)中进行。例如,执行一条 UPDATE 语句修改了某一行数据,对应的缓

OmniGlue论文详解(特征匹配)

OmniGlue论文详解(特征匹配) 摘要1. 引言2. 相关工作2.1. 广义局部特征匹配2.2. 稀疏可学习匹配2.3. 半稠密可学习匹配2.4. 与其他图像表示匹配 3. OmniGlue3.1. 模型概述3.2. OmniGlue 细节3.2.1. 特征提取3.2.2. 利用DINOv2构建图形。3.2.3. 信息传播与新的指导3.2.4. 匹配层和损失函数3.2.5. 与Super

web群集--nginx配置文件location匹配符的优先级顺序详解及验证

文章目录 前言优先级顺序优先级顺序(详解)1. 精确匹配(Exact Match)2. 正则表达式匹配(Regex Match)3. 前缀匹配(Prefix Match) 匹配规则的综合应用验证优先级 前言 location的作用 在 NGINX 中,location 指令用于定义如何处理特定的请求 URI。由于网站往往需要不同的处理方式来适应各种请求,NGINX 提供了多种匹