正文

[opencv][转载]利用级联分类器车辆检测训练

FL1623863129  FL1623863129  2023-01-14  773

关键词：

本文转载：Adaboost 卡口车辆检测训练 - Hello~again - 博客园

之前做了SVM的车脸检测，主要是针对车脸，接下来尝试利用Adaboost和Haar进行车脸的检测。我利用的主要是opencv中的cascade，其已经把Adaboost相关的算法做成了exe，直接调用就可以了，不像SVM中我们可能需要再调用。如果需要对boost源码进行修改，可以利用Cmake将生成opencv的源代码，（Cmake真是个很方便的东西，之前做交叉编译用Automake来弄，差点累的半死）。
首先我来介绍一下几个主要使用的工具。分别在opencv库路径下的，build/x64/vc10/bin目录下，你也可以选择vc11,12 或者x64,根据自己电脑的情况来使用。
　　主要我们使用的是opencv_createsamples.exe，opencv_traincascade.exe，其中前者主要是来创建训练的样本文件，vec文件。另外还有俩那个opencv_haartraining.exe，这个马上就要被淘汰了，主要是用c来实现的，并且仅支持haar这个特征描述子，opencv_performace，主要是用来测试模型的性能的。
　　级联分类器的参数设置，取自opencv官网，针对这两个exe的参数，opencv官网还有刚详细的链接
opencv官网cascade的详细参数讲解

下面是 opencv_traincascade (主要参数和haar_training还是有部分不同的)的命令行参数，以用途分组介绍：

通用参数：
　　-data <cascade_dir_name>
目录名，如不存在训练程序会创建它，用于存放训练好的分类器。
　　-vec <vec_file_name>
包含正样本的vec文件名（由 opencv_createsamples 程序生成）。
　　-bg <background_file_name>
背景描述文件，也就是包含负样本文件名的那个描述文件。
　　-numPos <number_of_positive_samples>
每级分类器训练时所用的正样本数目。
　　-numNeg <number_of_negative_samples>
每级分类器训练时所用的负样本数目，可以大于 -bg 指定的图片数目。
　　-numStages <number_of_stages>
训练的分类器的级数。
　　-precalcValBufSize <precalculated_vals_buffer_size_in_Mb>
缓存大小，用于存储预先计算的特征值(feature values)，单位为MB。
　　-precalcIdxBufSize <precalculated_idxs_buffer_size_in_Mb>
缓存大小，用于存储预先计算的特征索引(feature indices)，单位为MB。内存越大，训练时间越短。
　　-baseFormatSave
这个参数仅在使用Haar特征时有效。如果指定这个参数，那么级联分类器将以老的格式存储。
级联参数：
　　-stageType <BOOST(default)>
级别（stage）参数。目前只支持将BOOST分类器作为级别的类型。
　　-featureType<HAAR(default), LBP>
特征的类型： HAAR - 类Haar特征； LBP - 局部纹理模式特征。
　　-w
　　-h
训练样本的尺寸（单位为像素）。必须跟训练样本创建（使用 opencv_createsamples 程序创建）时的尺寸保持一致。这里需要注意的是ｗ，ｈ不要乱写啊，计算负责度开销很大，否则会严重影响训练速度，根据实际的需求来填写，我选择的是32×32,之前用了50×50很慢很慢
　　Boosted分类器参数：****
　　-bt <DAB, RAB, LB, GAB(default)>
　　Boosted分类器的类型： DAB - Discrete AdaBoost, RAB - Real AdaBoost, LB - LogitBoost, GAB - Gentle AdaBoost。
　　-minHitRate <min_hit_rate>
　　分类器的每一级希望得到的最小检测率。总的检测率大约为 min_hit_rate^number_of_stages。
　　-maxFalseAlarmRate <max_false_alarm_rate>
　　分类器的每一级希望得到的最大误检率。总的误检率大约为 max_false_alarm_rate^number_of_stages.
　　-weightTrimRate <weight_trim_rate>
　　Specifies whether trimming should be used and its weight. 一个还不错的数值是0.95。
　　-maxDepth <max_depth_of_weak_tree>
　　弱分类器树最大的深度。一个还不错的数值是1，是二叉树（stumps）。
　　-maxWeakCount <max_weak_tree_count>
　　每一级中的弱分类器的最大数目。The boosted classifier (stage) will have so many weak trees (<=maxWeakCount), as needed to achieve the given -maxFalseAlarmRate.
类Haar特征参数：
-mode <BASIC (default) | CORE | ALL>
　　选择训练过程中使用的Haar特征的类型。 BASIC 只使用右上特征， ALL 使用所有右上特征和45度旋转特征。

　　当opencv_traincascade 程序训练结束以后，训练好的级联分类器将存储于文件cascade.xml中，这个文件位于 -data 指定的目录中。这个目录中的其他文件是训练的中间结果，当训练程序被中断后，再重新运行训练程序将读入之前的训练结果，而不需从头重新训练。训练结束后，你可以删除这些中间文件。

注意事项，我训练时碰到的诸多问题！！！！！这里说的都是训练的关键！！！
1.首先是，train的bat文件和create_sample的bat文件中，大小宽高一定要一致，否则会报错。
2.run_train.bat中，对于缓冲区的大小的设置-precalcValBufSize，　-precalcIdxBufSize当时我为了训练的快一点，在服务器上设置的是5000，5000，换到另一台服务器上之后总报错，设置为4000MB就不报错了，可能是内存设置的过大，原则上是尽可能设置的较大，训练的速度会更快，其可以把计算的特征值存在内存中，不用虚拟内存。
3.在这里-numPos和-numNeg的设置，这里设置的是在每一级训练中参与训练的正样本和负样本个数，千万不要和训练的样本数一样，应该设置为80%左右适宜，否则容易陷入死循环，就是训练程序一直不动了，不走向下一级的训练。
4.有时会显示中途terminated，原因是每一级分配的numPos，numNeg太少，已经达到设定的精度需求，就不再继续下一级，此时加大numPos即可。
5.在样本数据集的准备上，首先至少要多点吧，最好是几千个，这才叫机器学习嘛。此外，负样本的数量一定要比正样本多，这样才能突出正样本，最好在1:2 1:3左右吧，根据训练的结果。其实，大家不要小看训练样本，其实这些都是固定的，算法形成基本就那样了，更关键的是在样本的准备上，对于最终的模型性能至关重要，不要小看样本。

首先我使用的是opencv下自带的opencv_createsamples.exe和opencv_opencv_traincascade.exe。
这个在opencv 的库目录bin下面可以找到。
由于这里使用的是编译好的工具exe，因此传入的参数我们通常通过写批处理文件bat文件来实现。
以下是run_createssamples.bat，需要自己建立

这里说明一下这个文件，-vec 制定生成的vec文件，-info指定正样本文件列表，-num指定样本数量，-w，-h指定样本的大小，需要主要的是样本的数量最后不要留有空行。
我这次训练的数据集正样本个数为6587，负样本个数为6584。这里对于负样本的讨论暂不展开，读者可以自己设置，我这里大致是1:1，看到一些别的人说1:2,1:3的效果比较好，读者可以自己控制个数作比较，但是训练的样本数至少在两三千以上才会有比较好的效果。
PosImageList32_32.txt内部是这样的,行中第一个参数是图片的路径，第二个参数是正样本个数，之后跟着的正样本的坐标，由于我这里已经将样本截取了出来车脸就是32*32，因此这里是直接给出0 0 32 32。

NegImageList.txt内部是这样的，直接给出负样本的文件路径即可,我这里负样本文件名中还有face，但已经是负样本不包含车脸，负样本一般最后跟实际的应用场景一致，在这里可以选取为卡口马路上的景象，杂物，行人，自行车等。

以下是run_traincascade_test2.bat，需要自己建立 !

详细说明一下这几个参数 -data 是用来存放模型的路径以及每一级生成的相关参数注意！！，在这里-data的路径必须自己手动设置，要不然会报错，说找不到这个路径，重要的事情说3遍！！ -vec用来指定正样本生成的向量文件，-bg是指定负样本文件文件，-numPos这里说明是每一级使用的正样本个数，一般为正样本数总量的80%左右，如果跟总样本数一致会导致无法收敛，也就是训练一致不结束，如果太少，训练的效果较差。 -numNeg同理， -numStages指定训练的级数，一般15-20级可以达到较好的效果，-precalcValBufSize 和 -precalcIdxBufSize 指定的是存储计算过程中特征和特征索引的缓存大小，在内存足够的情况下，这两个值设置的大一点可以加速训练过程，但是千万不要设置的太大，电脑内存不够，训练会报错的！！！ -maxWeakCount 设置每一级中弱分类器的最大个数，这里设置为150，-mode 指定使用harr特征中右上特征和旋转特征，-miniHitRate 每一级的最低的命中率，默认为0.995,这里设置为0,997， -maxFalseAlarmRate 最大误报率设置为0.5

OK设置好这些参数，就可以开启训练啦！！！！

训练过程，当可以中断训练，重新运行批处理文件，他会载入之前生成的中间文件，所以不影响。如果发现长时间一级下不去的话，可能是没收敛，需要重新调整参数，参见我上面说的。我运行了这个大概32*32的规模，运行了18级，每次取5000个样本计算，总共是花了3天时间才训练完。仅供参考

训练结束后生成18个过程的中间文件，以及最后的模型文件cascade.xml，我将在下一讲中介绍怎么使用这个模型文件。

这是我在应用过程中的一些见解和心得，网上也看了零零碎碎不少资料，希望能帮到你。如有错误，敬请指出。谢谢。

如何利用opencv自带的级联分类器训练程序训练分类器

首先，需要说明的是，OpenCV自带的haartraining提取的特征是haar特征分类器是AdaBoost级联分类器（如需了解Adaboost算法，。所谓的级联分类器，就是将若干的简单的分量分类器（可以理解为一般的普通分类器）依次串联起来，最终的... 查看详情

如何使用opencv中的adboost算法训练分类器

OpenCV训练分类器一、简介目标检测方法最初由PaulViola[Viola01]提出，并由RainerLienhart[Lienhart02]对这一方法进行了改善。该方法的基本步骤为：首先，利用样本（大约几百幅样本图片）的harr特征进行分类器训练，得到一个级联的booste... 查看详情

opencv车辆识别目标检测级联分类器c++案例实现(代码片段)

...类器Step1：准备好样本图像Step2：环境配置（OpenCVwin10）Step3：设置路径Step4：实现样本数据采集 Step5：实现样本数据训练Step6：生成级联分类器文件四、案例实现Step1：灰度处理Step2：二次压... 查看详情

opencv——人脸检测

OpenCV支持的目标检测的方法：利用样本的Haar特征进行的分类器训练，得到的级联boosted分类器（CascadeClassification）1.加载级联分类器CascadeClassifiercascade;cascade.load("haarcascade_frontalface_alt2.xml");2.打开视频VideoCapturecapture(0);if(!capture.i 查看详情

[opencv][转载]opencv级联分类器参数含义介绍(代码片段)

介绍OpenCV提供了两个程序可以训练自己的级联分类器：opencv_haartraining。opencv_traincascade。（新版本的opencv中只存在该分类器）opencv_traincascade是一个新程序，使用OpenCV2.xAPI以C++编写。这二者主要的区别是opencv_t... 查看详情

如何使用opencv自带工具训练人脸检测分类器

前言参考1.opencv人脸检测训练分类器及其常见问题-译文-Good；2.FAQ-opencv-haartraining-原文；3.人脸检测训练心得；4.opencv_traincascade支持Haar和LBP特征；5.如何使用opencv自带工具训练分类器；6.如何使用工具进行训练；7.如何训练详... 查看详情

OpenCV：良好的训练输出但级联分类器很差

】OpenCV：良好的训练输出但级联分类器很差【英文标题】：OpenCV:GoodTrainingOutputbutCascadeClassifierisPoor【发布时间】：2015-10-1520:09:30【问题描述】：对OpenCV非常陌生，我正在尝试训练一个可以从侧面检测狗图像的haar分类器。我以this... 查看详情

为旋转图像构建正样本以在 OpenCV 中进行级联训练

】为旋转图像构建正样本以在OpenCV中进行级联训练【英文标题】：buildingpositivesamplesforrotatedimagesforcascadedtraininginOpenCV【发布时间】：2014-02-1912:42:06【问题描述】：我需要训练一个级联分类器来检测车辆和不同的视角。我正在使用... 查看详情

为旋转图像构建正样本以在 OpenCV 中进行级联训练

如何用opencv训练自己的分类器

opencv5-objdetect之级联分类器

这是《opencv2.4.9tutorial.pdf》的objdetectmodule的唯一一个例子。在OpenCV中进行人脸或者人眼或者身体的检测首先就是训练好级联分类器，然后就是检测就行。在opencv中，“opencv/sources/data中就有内置训练好的：基于haar特征的级联分类... 查看详情

OpenCV 的级联分类器没有利用 CPU 的全部功能

】OpenCV的级联分类器没有利用CPU的全部功能【英文标题】：OpenCV\'scascadeclassifiernotutilizingfullpoweroftheCPU【发布时间】：2011-11-1317:02:49【问题描述】：我正在使用OpenCV的级联分类器进行检测，但是我的CPU利用率从未超过50%，但应用... 查看详情

机器学习-分类器-级联分类器训练（traincascadeclassifier）

一、简介：　　adaboost分类器由级联分类器构成，"级联"是指最终的分类器是由几个简单分类器级联组成。在图像检测中，被检窗口依次通过每一级分类器，这样在前面几层的检测中大部分的候选区域就被排除了，全部通过每一... 查看详情

OpenCV 级联分类器训练

】OpenCV级联分类器训练【英文标题】：OpenCVCascadeClassifierTraining【发布时间】：2017-11-2114:50:27【问题描述】：我参考thistutorial和thisfile来训练我自己的分类器。但我遇到了一些问题。我使用objectmarker.exe来生成info.txt。在info.txt中，... 查看详情

级联分类器训练-----opencv

关键词：级联分类器、opencv_traincascade下面简述操作过程：准备正负样本：neg、pos正负样本路径生成：dir/a/b>path.txt//path:posorneg正样本训练集生成：opencv_createsamples.exe-infopospos.txt-vecpospos.vec-num799-w24-h24 pause样本训练：opencv_tra 查看详情

opencv训练分类器样本处理

分类器的训练以分为以下三部进行：1、样本的创建2、训练分类器3、利用训练好的分类器进行目标检测。对检测物体要确定其属性：是否为绝对刚性的物体，也就是检测的目标是一个固定物体，没有变化（如特定公司的商标... 查看详情

[到手飞]用opencv的级联分类器一键训练自己的目标检测数据集(代码片段)

...到一个都算走运了。迫于无奈与时间紧迫，试了一下OpenCV的级联分类器，没想到效果虽谈不上惊人但绝对不算差。关键时刻还得是OpenCV靠谱。训练步骤：1.基础文件准备：需要创建一个文件夹，并且该文件夹下... 查看详情