端午节也不忘分享目标检测实战!

2024-01-13 09:40

本文主要是介绍端午节也不忘分享目标检测实战!,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

今天是中国传统节日——端午节!在此,祝大家节日快乐!

关注并星标

从此不迷路

计算机视觉研究院

746ec0c7ab23787d1e6b9e2d584b8fca.gif

729bfce961de3889199680cacebcaedb.gif

f0d1c0c4b02c244f72e01457c2aaa120.png

公众号ID|ComputerVisionGzq

学习群|扫码在主页获取加入方式

计算机视觉研究院专栏

作者:Edison_G

最近总是有很多入门的朋友问我们,进入计算机视觉这个领域难不难?是不是要学习很多知识?到底哪个方向比较好?

acd6a50d0a8d10d8a0b83db8e38fbe85.png

对于这些问题其实我们也不好回答他们,只能衷心告诉他们,如果你对这领域特别感兴趣,那你可以进来试试玩玩,如果试过了玩过了,觉得这不是你喜欢的领域,那你可以立马退出,选择你喜欢的领域方向。

e9db0d9736e40af68b5a1482f5bd20a6.png

我个人一直认为,科研这个东西,真的是要有兴趣爱好,这是你动力和创新的源泉。只有对自己选择的领域有兴趣,有动力深入挖掘,我觉得一定会做得很好,可能还会创造出许多意想不到的结果。

如果现在你们入门的朋友,选择了目标检测类,你们可以没事玩玩今天说的框架和网络,这个过程真的可以学习很多东西,只要你愿意花费时间和精力去深入,现在我们闲话少说,直接进入正题。


正如我之前说的:深度学习近期总结分析。在目标检测中,有很多经典的网络框架,比如RCNN,SSP,Fast RCNN。其中Fast RCNN就使用Selective Search来进行候选区域,但是速度依然不够快。今天的主角(Faster R-CNN)则直接利用RPN(Region Proposal Networks)网络来计算候选框。RPN以一张任意大小的图片为输入,输出一批矩形候选区域,每个区域对应一个目标分数和位置信息。Faster R-CNN中的RPN结构如图所示。

a60ccd4c65ce638b59b85c848159788f.png

Faster RCNN的主要步骤如下:

  1. 特征提取:同Fast RCNN,以整张图片为输入,利用CNN得到图片的特征层;

  2. 候选区域:在最终的卷积特征层上利用k个不同的矩形框(Anchor Box)进行提名,k一般取9;

  3. 分类与回归:对每个Anchor Box对应的区域进行object/non-object二分类,并用k个回归模型(各自对应不同的Anchor Box)微调候选框位置与大小,最后进行目标分类。

总之,Faster RCNN抛弃了Selective Search,引入了RPN网络,使得候选区域、分类、回归一起共用卷积特征,从而得到了进一步的加速。但是,Faster RCNN需要对两万个Anchor Box先判断是否是目标(目标判定),然后再进行目标识别,分成了两步。

今天就来讲讲怎么简单操作该网络,以便后期有兴趣的朋友再次基础上做出改进。


一、git官网的py-faster-rcnn源码

终端输入:cd /home/**(您服务器的名字)

                    git clone --recursive https://github.com/rbgirshick/py-faster-rcnn.git

二、生成Cython模块

终端输入:cd /home/**(您服务器的名字)/py-faster-rcnn/lib
                   make

三、生成Caffe和pycaffe

终端输入:cd /home/**(您服务器的名字)/py-faster-rcnn/caffe-fast-rcnn
                    cp Makefile.config.example Makefile.config
打开Makefile.config,修改之处可以根据您自己需求修改(比如你要使用Python,GPU等功能)
保存退出。

终端输入:cd /home/**(您服务器的名字)/py-faster-rcnn/caffe-fast-rcnn

                    mkdir build
                    cd build
                    cmake ..(注意这是两个句点,不要忘记)
                    make all -j16("‐j16"是使用 CPU 的多核进行编译,可以提速,根据您自己

                    硬件调整)
                    make install
                    make runtest -j16

                    make pycaffe(编译pycaffe)

四、下载fetch_fast_rcnn_models

终端输入:cd /home/**(您服务器的名字)/py-faster-rcnn
                    ./data/scripts/fetch_faster_rcnn_models.sh

五、运行demo.py

终端输入:cd /home/home/**(您服务器的名字)/py-faster-rcnn/tools
                    ./demo.py

e20c114bc634f62903ed76da8987d182.png

到这几,基本的都完成了,接下来就是实现自己的数据train和demo。


一、首先制作自己的数据集(如果您用公共数据集,那就可以忽略这步骤)

保留data/VOCdevkit2007/VOC2007/Annotations和ImageSets和JPEGImages文件夹名称,删除其中所有的文件(保留文件夹)。其中Annotations保存标签txt转换的xml文件,ImageSets保存train.txt、trainval.txt、test.txt、val.txt四个文件分别储存在layout、main和Segmentation文件夹中,最后JPEGImages保存所训练的数据。

然后,Annotations中xml文件的制作。该部分的代码我会放在公众平台的共享文件菜单中。最后做出来的效果就是如下所示:

f1f412adca0ecdf0a8b49a03a4f8538c.png

最终生成的格式如下:

987f55e159ded4006d41cf95c57cc75f.png

最后在ImageSets中的trainval文件中,根据你自己来划分!


二、修改参数和文件

  •  prototxt配置文件

models/pascal_voc/ZF/faster_rcnn_alt_opt文件夹下的5个文件,分别为:stage1_rpn_train.pt、stage1_fast_rcnn_train.pt、stage2_rpn_train.pt、stage2_fast_rcnn_train.pt和fast_rcnn_test.pt,修改格式如下:

(1)stage1_fast_rcnn_train.pt和stage2_fast_rcnn_train.pt修改参数:

num_class:2(识别1类+背景1类),cls_score中num_output:2,bbox_pred中num_output:8

(2)stage1_rpn_train.pt和stage2_rpn_train.pt修改参数:

num_class:2(识别1类+背景1类)

(3)fast_rcnn_test.pt修改参数:

cls_score中num_output:2,bbox_pred中num_output:8(只有这2个)

  • 修改lib/datasets/pascal_voc.py

self._classes = ('__background__', # always index 0  'zongzi')(只有这一类)

  • 修改lib/datasets/imdb.py

数据整理,在一行代码为:

boxes[:, 2] = widths[i] - oldx1 - 1  下加入代码:
 for b in range(len(boxes)):

      if boxes[b][2]< boxes[b][0]:

         boxes[b][0] = 0

  • 修改完pascal_voc.py和imdb.py后进入lib/datasets目录下删除原来的pascal_voc.pyc和imdb.pyc文件,重新生成这两个文件,因为这两个文件是python编译后的文件,系统会直接调用。

终端进入lib/datasets文件目录输入:

python(此处应出现python的版本)

>>>importpy_compile

>>>py_compile.compile(r'imdb.py')

>>>py_compile.compile(r'pascal_voc.py')


三、现在我们开始训练自己数据

终端进入py-faster-rcnn下输入:

./experiments/scripts/faster_rcnn_alt_opt.sh0 ZF pascal_voc


四、运行demo

运行demo,即在py-faster-rcnn文件夹下终端输入:

./tools/demo.py --net zf

其中修改/tools/demo.py为:

(1) CLASSES =('__background__',  'zongzi')

(2) NETS ={'vgg16': ('VGG16', 'VGG16_faster_rcnn_final.caffemodel'),

                     'zf': ('ZF', 'ZF_faster_rcnn_final.caffemodel')}


效果图:

注:有部分目标没有检测出来,可能是由于目标遮挡,重叠造成,所以往后需要我们大家做的就是,怎么去解决实际生活中遇到的种种问题,利用所学的知识和自己的创新去改进,优化!

由于今天是端午假,大家都会吃粽子,所以今天的目标检测就是“粽子”,通过各种渠道得到粽子的训练和测试数据集,最后得到如下部分的结果可视化图。

67f8c590e7fac8d066bfb49f64422f58.png

© THE END 

转载请联系本公众号获得授权

dabfa44cf09fb5820a05225155fc3f6c.gif

计算机视觉研究院学习群等你加入!

计算机视觉研究院主要涉及深度学习领域,主要致力于人脸检测、人脸识别,多目标检测、目标跟踪、图像分割等研究方向。研究院接下来会不断分享最新的论文算法新框架,我们这次改革不同点就是,我们要着重”研究“。之后我们会针对相应领域分享实践过程,让大家真正体会摆脱理论的真实场景,培养爱动手编程爱动脑思考的习惯!

988c5c31559623f9311aa1ff79134023.png

扫码关注

计算机视觉研究院

公众号ID|ComputerVisionGzq

学习群|扫码在主页获取加入方式

 往期推荐 

🔗

  • NAACL2022:(代码实践)好的视觉引导促进更好的特征提取,多模态命名实体识别(附源代码下载)

  • CVPR最佳检测:不再是方方正正的目标检测输出(附源码)

  • Poly-YOLO:更快,更精确的检测(主要解决Yolov3两大问题,附源代码)

  • “YoloV7”?目标检测算法终结篇:正式开源

  • CLCNet:用分类置信网络重新思考集成建模(附源代码下载)

  • Yolo-Fastest:轻量级yolo系列网络在各硬件实现工业级检测效果

  • 霸榜第一框架:工业检测,基于差异和共性的半监督方法用于图像表面缺陷检测

  • Fast YOLO:用于实时嵌入式目标检测(附论文下载)

  • 计算机视觉研究院:AI部署以及工业落地学习之路(文章较长,建议收藏)

  • 目标检测干货 | 多级特征重复使用大幅度提升检测精度(文末附论文下载)

  • 多尺度深度特征(下):多尺度特征学习才是目标检测精髓(论文免费下载)

  • 多尺度深度特征(上):多尺度特征学习才是目标检测精髓(干货满满,建议收藏)

这篇关于端午节也不忘分享目标检测实战!的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/601028

相关文章

Python并行处理实战之如何使用ProcessPoolExecutor加速计算

《Python并行处理实战之如何使用ProcessPoolExecutor加速计算》Python提供了多种并行处理的方式,其中concurrent.futures模块的ProcessPoolExecu... 目录简介完整代码示例代码解释1. 导入必要的模块2. 定义处理函数3. 主函数4. 生成数字列表5.

Python虚拟环境与Conda使用指南分享

《Python虚拟环境与Conda使用指南分享》:本文主要介绍Python虚拟环境与Conda使用指南,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、python 虚拟环境概述1.1 什么是虚拟环境1.2 为什么需要虚拟环境二、Python 内置的虚拟环境工具

Java Spring 中的监听器Listener详解与实战教程

《JavaSpring中的监听器Listener详解与实战教程》Spring提供了多种监听器机制,可以用于监听应用生命周期、会话生命周期和请求处理过程中的事件,:本文主要介绍JavaSprin... 目录一、监听器的作用1.1 应用生命周期管理1.2 会话管理1.3 请求处理监控二、创建监听器2.1 Ser

Apache 高级配置实战之从连接保持到日志分析的完整指南

《Apache高级配置实战之从连接保持到日志分析的完整指南》本文带你从连接保持优化开始,一路走到访问控制和日志管理,最后用AWStats来分析网站数据,对Apache配置日志分析相关知识感兴趣的朋友... 目录Apache 高级配置实战:从连接保持到日志分析的完整指南前言 一、Apache 连接保持 - 性

MQTT SpringBoot整合实战教程

《MQTTSpringBoot整合实战教程》:本文主要介绍MQTTSpringBoot整合实战教程,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考... 目录MQTT-SpringBoot创建简单 SpringBoot 项目导入必须依赖增加MQTT相关配置编写

Python处理大量Excel文件的十个技巧分享

《Python处理大量Excel文件的十个技巧分享》每天被大量Excel文件折磨的你看过来!这是一份Python程序员整理的实用技巧,不说废话,直接上干货,文章通过代码示例讲解的非常详细,需要的朋友可... 目录一、批量读取多个Excel文件二、选择性读取工作表和列三、自动调整格式和样式四、智能数据清洗五、

JavaScript实战:智能密码生成器开发指南

本文通过JavaScript实战开发智能密码生成器,详解如何运用crypto.getRandomValues实现加密级随机密码生成,包含多字符组合、安全强度可视化、易混淆字符排除等企业级功能。学习密码强度检测算法与信息熵计算原理,获取可直接嵌入项目的完整代码,提升Web应用的安全开发能力 目录

Redis迷你版微信抢红包实战

《Redis迷你版微信抢红包实战》本文主要介绍了Redis迷你版微信抢红包实战... 目录1 思路分析1.1hCckRX 流程1.2 注意点①拆红包:二倍均值算法②发红包:list③抢红包&记录:hset2 代码实现2.1 拆红包splitRedPacket2.2 发红包sendRedPacket2.3 抢

JDK9到JDK21中值得掌握的29个实用特性分享

《JDK9到JDK21中值得掌握的29个实用特性分享》Java的演进节奏从JDK9开始显著加快,每半年一个新版本的发布节奏为Java带来了大量的新特性,本文整理了29个JDK9到JDK21中值得掌握的... 目录JDK 9 模块化与API增强1. 集合工厂方法:一行代码创建不可变集合2. 私有接口方法:接口

电脑系统Hosts文件原理和应用分享

《电脑系统Hosts文件原理和应用分享》Hosts是一个没有扩展名的系统文件,当用户在浏览器中输入一个需要登录的网址时,系统会首先自动从Hosts文件中寻找对应的IP地址,一旦找到,系统会立即打开对应... Hosts是一个没有扩展名的系统文件,可以用记事本等工具打开,其作用就是将一些常用的网址域名与其对应