[目标跟踪]-质心追踪算法(centroid tracking)原理简介及python+opencv实现

本文主要是介绍[目标跟踪]-质心追踪算法(centroid tracking)原理简介及python+opencv实现,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

1.目标跟踪

对于一个视频流或者是实时检测的摄像输入,我们可以把整个过程看作N帧图像的合集,那么如果在其中的某一帧出现了我们感兴趣的目标,需要在后续目标继续关注,就要用到目标跟踪.
即我们只在目标的初始帧进行检测+识别,而在后续帧不进行识别,仅仅利用跟踪算法始终关注,进行检测,这样做可以,某些情况下降低计算量,提升视频的流畅度,即FPS提升.

2.核心思想

  1. 对于整个视频流,通过检测算法对预设的感兴趣的全部目标的第一次出现得到其位置坐标;
  2. 为这些第一次出现的ROI 创建 ID;
  3. 在视频流中的后续帧,寻找帧之间目标对象的关系,将帧之间的目标关联起来;

3.算法需求

  1. 对整个视频流只对感兴趣目标出现的第一帧进行检测识别
  2. 目标消失,超出边界情况可以正确处理
  3. 受限于检测算法,能够接受整个视频流中某几帧之间对象目标消失,然后再次出现的情况
  4. 能够优化现有检测方式的速度,提升FPS

4.质心追踪算法

4.1为什么需要

假设在一个视频流中,始终只有一个目标,默认情况如下:

  • 情况1,该目标整个视频流中都出现,且未出现目标消失或超出边界情况
  • 情况2,整个视频流中同一时刻只有一个目标或没有目标

以上是说明我们只需要在整个视频流中跟踪一个目标,它第一次出现在N帧,我们对第N帧做检测+识别,后续的N+1帧都做跟踪,直至目标离开.
当新目标出现时,同理只在他出现的那一帧做检测+识别,后续都只做检测+跟踪,即保证统一时刻整个视频流中只有一个目标或者没有目标.
在这里插入图片描述
在这里插入图片描述
这样只在目标出现的第一帧,做检测+识别,给定ID后续只对ID追踪,减少了每一帧的识别步骤FPS大幅度提升.

以上的前提都是整个视频流最多只有一个目标出现,但是如果有多个目标呢?要如何进行匹配?以下为例:
在这里插入图片描述
问题来了

当视频流中只有一个目标时,很容易跟踪确定ID
但是当视频流出现多个目标,由于我们后续帧不做识别,我们知道这里有两个目标,但是不清楚哪个是熊大,哪个是熊二

4.2质心追踪算法

质心追踪算法就是为了来解决上述问题.判断后续帧检查出的目标,确定ID归属,从而得出哪个是熊大哪个是熊二.
依赖于在视频流的连续帧中,比较已知目标和新出现目标之间质心的欧氏距离

步骤1:计算目标质心
在这里插入图片描述
对于目标对象的第一次出现,进行检测+识别,给定目标ID,每一帧都计算目标质心.

步骤2:计算后续帧目标质心的欧式距离
在这里插入图片描述
注意看,这里我们就不需要做识别了,只做检测,然后计算质心.
分别计算新旧欧式距离

  • 蓝1与绿1 ;蓝1与绿2
  • 蓝2与绿1 ;蓝2与绿2

步骤三:更新已知目标的质心坐标
质心追踪算法的前提是:对于一个给定目标,将会在后续帧中都出现,而且在第 N 帧和 N+1 帧中的质心欧氏距离,要小于不同目标之间的欧式距离;

因此我们在视频流的连续帧之间,根据欧氏距离最小原则,将这些帧中特征框的质心联系起来,可以得到一个目标 X 在这些连续帧中的变化联系,就达到了我们目标追踪的目的;

在这里插入图片描述

这里假设 蓝色的点是 在第N帧时,两只熊第一次出现,我们这时 要做检测+识别 给定身份ID,同时计算检测框目标质心.
而再第N+1帧,这时目标已经不是第一是出现了,我们只做检测,同时计算新旧质心欧式距离,更新目标X质心的变化,从而给定身份ID

也就是说,目标的第一次出现身份ID是识别来的,后续的都是通过目标跟踪算法来绑定的
目标跟踪算法所需要的计算量是远远小于识别的,提升了FPS

疑问一:注册新目标
每次增加新目标的话,比如第N帧有a个目标,第N+1帧有a+1个目标,对于新目标我们要做

  1. 检测+识别,给定身份ID
  2. 计算质心坐标供后续使用

疑问二:注销旧目标
当一个目标在后续的视频流消失时,有以下两种处理方式

  1. 在第N帧消失,注销目标质心位置,注销目标身份ID
  2. 在第N帧消失,且后续的T帧都没有再次出现,注销目标质心,注销身份ID

5.代码部分

待补充

6.参考

1.深度学习中的目标追踪概述(VOT in DeepLearning)
2.目标跟踪入门
3.目标追踪(Object Tracking)概念的简要介绍
4.OpenCV目标跟踪之简单质心跟踪

这篇关于[目标跟踪]-质心追踪算法(centroid tracking)原理简介及python+opencv实现的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/179698

相关文章

Java调用Python的四种方法小结

《Java调用Python的四种方法小结》在现代开发中,结合不同编程语言的优势往往能达到事半功倍的效果,本文将详细介绍四种在Java中调用Python的方法,并推荐一种最常用且实用的方法,希望对大家有... 目录一、在Java类中直接执行python语句二、在Java中直接调用Python脚本三、使用Run

使用Python开发Markdown兼容公式格式转换工具

《使用Python开发Markdown兼容公式格式转换工具》在技术写作中我们经常遇到公式格式问题,例如MathML无法显示,LaTeX格式错乱等,所以本文我们将使用Python开发Markdown兼容... 目录一、工具背景二、环境配置(Windows 10/11)1. 创建conda环境2. 获取XSLT

Python如何调用指定路径的模块

《Python如何调用指定路径的模块》要在Python中调用指定路径的模块,可以使用sys.path.append,importlib.util.spec_from_file_location和exe... 目录一、sys.path.append() 方法1. 方法简介2. 使用示例3. 注意事项二、imp

Java根据IP地址实现归属地获取

《Java根据IP地址实现归属地获取》Ip2region是一个离线IP地址定位库和IP定位数据管理框架,这篇文章主要为大家详细介绍了Java如何使用Ip2region实现根据IP地址获取归属地,感兴趣... 目录一、使用Ip2region离线获取1、Ip2region简介2、导包3、下编程载xdb文件4、J

PyQt5+Python-docx实现一键生成测试报告

《PyQt5+Python-docx实现一键生成测试报告》作为一名测试工程师,你是否经历过手动填写测试报告的痛苦,本文将用Python的PyQt5和python-docx库,打造一款测试报告一键生成工... 目录引言工具功能亮点工具设计思路1. 界面设计:PyQt5实现数据输入2. 文档生成:python-

Android实现一键录屏功能(附源码)

《Android实现一键录屏功能(附源码)》在Android5.0及以上版本,系统提供了MediaProjectionAPI,允许应用在用户授权下录制屏幕内容并输出到视频文件,所以本文将基于此实现一个... 目录一、项目介绍二、相关技术与原理三、系统权限与用户授权四、项目架构与流程五、环境配置与依赖六、完整

Python中Flask模板的使用与高级技巧详解

《Python中Flask模板的使用与高级技巧详解》在Web开发中,直接将HTML代码写在Python文件中会导致诸多问题,Flask内置了Jinja2模板引擎,完美解决了这些问题,下面我们就来看看F... 目录一、模板渲染基础1.1 为什么需要模板引擎1.2 第一个模板渲染示例1.3 模板渲染原理二、模板

浅析如何使用xstream实现javaBean与xml互转

《浅析如何使用xstream实现javaBean与xml互转》XStream是一个用于将Java对象与XML之间进行转换的库,它非常简单易用,下面将详细介绍如何使用XStream实现JavaBean与... 目录1. 引入依赖2. 定义 JavaBean3. JavaBean 转 XML4. XML 转 J

Flutter实现文字镂空效果的详细步骤

《Flutter实现文字镂空效果的详细步骤》:本文主要介绍如何使用Flutter实现文字镂空效果,包括创建基础应用结构、实现自定义绘制器、构建UI界面以及实现颜色选择按钮等步骤,并详细解析了混合模... 目录引言实现原理开始实现步骤1:创建基础应用结构步骤2:创建主屏幕步骤3:实现自定义绘制器步骤4:构建U

使用Python创建一个功能完整的Windows风格计算器程序

《使用Python创建一个功能完整的Windows风格计算器程序》:本文主要介绍如何使用Python和Tkinter创建一个功能完整的Windows风格计算器程序,包括基本运算、高级科学计算(如三... 目录python实现Windows系统计算器程序(含高级功能)1. 使用Tkinter实现基础计算器2.