在yolov3上训练自己的数据集+jetsonnano上运行tiny-yolov3_jetson nano yolov3-程序员宅基地

技术标签: jetsonnano  深度学习  tiny-yolov3  yolov3  

本篇文章主要是介绍一个完整快速的训练自定义目标的全过程,具体其中一些为什么另起一篇文章详细介绍

一、在PC机上实现yolov3

1.下载darknet工程

我们在github上下载其源码工程

git clone https://github.com/pjreddie/darknet.git

2.修改Makefile并编译出darknet

进入到下载好的darknet文件夹根目录下,修改Makefile中的前五行为

GPU=1                                                                                                                                                                                                   
CUDNN=1
OPENCV=1
OPENMP=0
DEBUG=1

(因为我们在PC机上已经安装好了cuDNN、OPENCV以及1660显卡,所以需要设置上面的相关几行)

在darknet工程根目录下执行编译命令

make -j6

最终我们在darknet目录下编译出了可执行文件 darknet,即darknet安装完成

3.下载预训练模型 

#下载预训练模型
wget https://pjreddie.com/media/files/yolov3.weights

#下载yolov3-tiny模型
wget https://pjreddie.com/media/files/yolov3-tiny.weights

#预训练权重文件
wget https://pjreddie.com/media/files/darknet53.conv.74

4.使用下载好的模型进行测试

测试图片检测

#标准模型检测
./darknet detect cfg/yolov3.cfg yolov3.weights data/dog.jpg

#tiny模型检测
./darknet detect cfg/yolov3-tiny.cfg yolov3-tiny.weights data/dog.jpg

测试摄像头实时视频(接入usb摄像头)

#标准的模型测试
./darknet detector demo cfg/coco.data cfg/yolov3.cfg yolov3.weights

#tiny模型测试
./darknet detector demo cfg/coco.data cfg/yolov3-tiny.cfg yolov3-tiny.weights

当我们在上面的命令如果出现 CUDA Error: out of memory ,只需要修改所使用的模型cfg文件

例如:yolov3.cfg文件

第七行中的 subdivisions=16 修改为 subdivisions=32

cfg中的

   batch:是指一次输入多少图片到神经网络中来计算loss,并反向update gradients

   subdivisions它会让你的每一个batch不是一下子都丢到网络里。而是分成subdivision对应数字的份数,一份一份的跑完后,在一起打包算作完成一次iteration。这样会降低对显存的占用情况,因为本身我的1660显卡显存不是很大,才6G。如果设置这个参数为1的话就是一次性把所有batch的图片都丢到网络里,如果为2的话就是一次丢一半。 如果使用默认16的话,就是说将batch分为16份但是显存装不下,所以设置为 32

从上面的测试中我们也可以看到,在执行命令后打印的网络层数tiny模型层数明显少于标准模型,且在测试图片后还会打印当前图片检测所花费的时间,tiny模型检测时间相比较短,所以tiny检测的精度与速度自然比不上标准模型,但是其提升了检测速度,降低了GPU硬件门槛

5.制作检测目标的 VOC2012数据集 

5.1 准备图片集

这里我以公司一卡通为例子,采集拍摄了总共260张图片,分辨率为960*960,大概如下:

在 scripts 目录下创建如下的文件夹,将上面采集到260张图片放到JPEGImages目录下

我们首先要对采集到图片进行重命名排序,这里统一命名为 2020_000001.jpg ~2020_000260.jpg

写了一个简单的python小程序--modify_name.py对JPEGImages中的图片进行重命名排序,这里贴出来具体如下:

import os
import sys

#path为路径名,这里修改为 JPEGImages文件夹的绝对路径即可
path = '/xxx/xxx/xxx/darknet-master/scripts/VOCdevkit/VOC2012/JPEGImages'
i = 1

for filename in os.listdir(path):
    oldDirPath = os.path.join(path,filename)
    print(oldDirPath)
    fileName = os.path.splitext(filename)[0]
    fileType = os.path.splitext(filename)[1]
    newDirPath = os.path.join(path,'2020_'+str("%06d"%(i))+fileType)
    print(newDirPath)
    os.rename(oldDirPath, newDirPath)
    i += 1

5.2给图片打标签

这里给上面的图片集打标签需要借助到 labelImg 这一款软件,这个软件有linux版本和windows版本 ,具体的安装以及使用可以在网络上找到,这里就不详细说明,这里我们新建的标签为 hr_card

5.3指定数据集和测试集

我们做好的数据集要一部分作为训练集来训练模型,需要另一部分作为测试集来帮助我们验证模型的可靠性.因此首先要将所有的图像文件随机分配为训练集和测试集.

我们在ImageSets的Main文件夹下新建train.txt 和 val..txt 空白文件分别用于存放训练集的文件名列表和测试集的文件名列表.

使用如下的脚本--make_train_val.txt 用于生成训练集和测试机(这里我使用260张图片的210张用于训练集,50张用于验证集)

import os
from os import listdir, getcwd
from os.path import join

if __name__ == '__main__':
    source_folder = '/xx/xx/xx/darknet-master/scripts/VOCdevkit/VOC2012/JPEGImages/'              # 图片数据集的路径
    train_path    = '/xx/xx/xx/darknet-master/scripts/VOCdevkit/VOC2012/ImageSets/Main/train.txt' # 训练集路径
    val_path      = '/xx/xx/xx/darknet-master/scripts/VOCdevkit/VOC2012/ImageSets/Main/val.txt'   # 验证集路径

    file_list  = os.listdir(source_folder)       
    train_file = open(train_path, 'a')                 
    val_file   = open(val_path, 'a')   
    count      = 0               

    for file_obj in file_list:
        count += 1                
        file_name,file_extend=os.path.splitext(file_obj)
        if(count<211):
            train_file.write(file_name+'\n') # 前210个数据收录为训练集
        else :
            val_file.write(file_name+'\n') #剩下50张图片数据作为验证集
    train_file.close()
    val_file.close()

执行该脚本我们可以看到在train.val 中存在随机抽取的210个图片文件名,val.txt文件中有存放着50个图片文件名

5.4 指定训练集和测试集的实际路径和标签文件

修改 scripts文件夹下的 voc_label.py 文件来生成训练集和测试集的实际路径文件以及其对应的标签文件

数据集sets修改:我们生成的数据集为训练集和验证集且版本为2012版本

分类classes:因为我们当前只检测一种目标 "hr_card",如果你的数据集中有标注多个目标,这里同样需要添加数量

将2012_train.txt 和 2012_val.txt中的所有数据路径输入到train.txt

执行voc_lable.py脚本,我们就生成了 scripts/2012_train.txt 、2012_val.txt 、train.txt三个文件,以及在数据集 scripts/VOCdevkit/VOC2012/labels 生成了每一个图片数据的标签文件

6.配置yolov3相关文件

6.1 修改 darknet-master/data/voc.names

这里添加自己目标类名,我这里只有一类,所以只需要一行,即

hr_card

6.2 修改darknet-master/cfg/voc.data

按照实际情况修改,这里我只有一类,训练集和测试集路径修改即可

6.3 修改darknet-master/cfg/中的 yolov3-tiny.cfg 或者 yolov3-voc.cfg

6.3.1 yolov3-tiny版本

tiny版本我们需要修改cfg目录下的yolov3-tiny.cfg文件

现在我们需要训练模型,不需要测试,所以将yolov3-tiny.cfg中的Testing下面的batch=1、subdivisions=1注释,释放Training下面的两行,并修改subdivisions=32,修改为32的原因前面已经说明,这里不再赘述

classes=1 ,因为我们只有一类

filters=3*(classes+5),因为我们的classes=1,所以filters=18

生成预训练模型

./darknet partial cfg/yolov3-tiny.cfg yolov3-tiny.weights yolov3-tiny.conv.15 15

训练模型

./darknet detector train cfg/voc.data cfg/yolov3-tiny.cfg yolov3-tiny.conv.15 | tee tiny_hr_card_train_log.txt

训练一段时间后,我们可以按‘ctrl+c’手动结束模型训练,然后可以在backup中找到相应的训练模型,这里我选择的训练模型为 yolov3-tiny_900.weights

训练结束后执行

我们需要修改yolov3-tiny.cfg,注释掉Training,启用Testing

执行如下命令实现实时检测我们自定义的目标

./darknet detector demo cfg/voc.data cfg/yolov3-tiny.cfg backup/yolov3-tiny_900.weights

接下来我们可以将上面训练的模型放到jetsonnano上去运行,有点类似于交叉编译的感觉,这样就不用在jetsonnano上去训练模型了,本身jetsonnano训练模型速度肯定比不上PC端的显卡。

这里我省事一点,不想重复修改上面的一些cfg文件,直接将目前的darknet-master文件夹进行打包,然后发送到jetsonnano上解压

在解压后的darknet-master文件中执行make clean,清除掉前面在pc端生成的一些x86架构上才能运行的执行文件,因为我们现在是在arm上跑,所以需要make clean,重新执行make生成arm架构的darknet等文件。

重新make之后我们直接执行上面的实时检测目标的命令即可实现了,如下图所示,已经能够实时检测我手里的这张卡了(虽然目前的帧率很低,fps大约在6左右,需要进一步的优化。。。)

6.3.2 yolov3版本

我们修改的cfg文件为yolov3-voc.cfg,其具体的修改记录如下:

这里的random表示多尺度训练开关,这个参数仅影响训练速度,当我们的GPU显存较小,我们可以考虑关闭多尺度训练,即random=0,classes和filters设置参数和前面tiny版本一致

模型训练命令,附带保存一些训练时的数据log,log可以用来生成训练相关曲线等便于分析优化:

./darknet detector train cfg/voc.data cfg/yolov3-voc.cfg scripts/darknet53.conv.74 | tee train_yolov3-voc.log

同理,训练一段时间后我们执行‘ctrl+c’结束模型训练,然后在backup中找到相应的模型,例如这里的:yolov3-voc_900.weights

然后我们修改yolov3-voc.cfg文件,和前面tiny一样,注释掉Training,启用Testing中的batch和subdivisions

摄像头实时监测自定义目标命令:

./darknet detector demo cfg/voc.data cfg/yolov3-voc.cfg backup/yolov3-voc_900.weights

可以在PC端实现实时检测自定义目标了

附录:

本文参考以下博客:

使用yolov3-tiny训练自己的图像数据以及在jetson Nano上的测试

版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明。
本文链接:https://blog.csdn.net/zz531987464/article/details/104403128

智能推荐

FTP命令字和返回码_ftp 登录返回230-程序员宅基地

文章浏览阅读3.5k次,点赞2次,收藏13次。为了从FTP服务器下载文件,需要要实现一个简单的FTP客户端。FTP(文件传输协议) 是 TCP/IP 协议组中的应用层协议。FTP协议使用字符串格式命令字,每条命令都是一行字符串,以“\r\n”结尾。客户端发送格式是:命令+空格+参数+"\r\n"的格式服务器返回格式是以:状态码+空格+提示字符串+"\r\n"的格式,代码只要解析状态码就可以了。读写文件需要登陆服务器,特殊用..._ftp 登录返回230

centos7安装rabbitmq3.6.5_centos7 安装rabbitmq3.6.5-程序员宅基地

文章浏览阅读648次。前提:systemctl stop firewalld 关闭防火墙关闭selinux查看getenforce临时关闭setenforce 0永久关闭sed-i'/SELINUX/s/enforcing/disabled/'/etc/selinux/configselinux的三种模式enforcing:强制模式,SELinux 运作中,且已经正确的开始限制..._centos7 安装rabbitmq3.6.5

idea导入android工程,idea怎样导入Android studio 项目?-程序员宅基地

文章浏览阅读5.8k次。满意答案s55f2avsx2017.09.05采纳率:46%等级:12已帮助:5646人新版Android Studio/IntelliJ IDEA可以直接导入eclipse项目,不再推荐使用eclipse导出gradle的方式2启动Android Studio/IntelliJ IDEA,选择 import project3选择eclipse 项目4选择 create project f..._android studio 项目导入idea 看不懂安卓项目

浅谈AI大模型技术:概念、发展和应用_ai大模型应用开发-程序员宅基地

文章浏览阅读860次,点赞2次,收藏6次。AI大模型技术已经在自然语言处理、计算机视觉、多模态交互等领域取得了显著的进展和成果,同时也引发了一系列新的挑战和问题,如数据质量、计算效率、知识可解释性、安全可靠性等。城市运维涉及到多个方面,如交通管理、环境监测、公共安全、社会治理等,它们需要处理和分析大量的多模态数据,如图像、视频、语音、文本等,并根据不同的场景和需求,提供合适的决策和响应。知识搜索有多种形式,如语义搜索、对话搜索、图像搜索、视频搜索等,它们可以根据用户的输入和意图,从海量的数据源中检索出最相关的信息,并以友好的方式呈现给用户。_ai大模型应用开发

非常详细的阻抗测试基础知识_阻抗实部和虚部-程序员宅基地

文章浏览阅读8.2k次,点赞12次,收藏121次。为什么要测量阻抗呢?阻抗能代表什么?阻抗测量的注意事项... ...很多人可能会带着一系列的问题来阅读本文。不管是数字电路工程师还是射频工程师,都在关注各类器件的阻抗,本文非常值得一读。全文13000多字,认真读完大概需要2小时。一、阻抗测试基本概念阻抗定义:阻抗是元器件或电路对周期的交流信号的总的反作用。AC 交流测试信号 (幅度和频率)。包括实部和虚部。​图1 阻抗的定义阻抗是评测电路、元件以及制作元件材料的重要参数。那么什么是阻抗呢?让我们先来看一下阻抗的定义。首先阻抗是一个矢量。通常,阻抗是_阻抗实部和虚部

小学生python游戏编程arcade----基本知识1_arcade语言 like-程序员宅基地

文章浏览阅读955次。前面章节分享试用了pyzero,pygame但随着想增加更丰富的游戏内容,好多还要进行自己编写类,从今天开始解绍一个新的python游戏库arcade模块。通过此次的《连连看》游戏实现,让我对swing的相关知识有了进一步的了解,对java这门语言也有了比以前更深刻的认识。java的一些基本语法,比如数据类型、运算符、程序流程控制和数组等,理解更加透彻。java最核心的核心就是面向对象思想,对于这一个概念,终于悟到了一些。_arcade语言 like

随便推点

【增强版短视频去水印源码】去水印微信小程序+去水印软件源码_去水印机要增强版-程序员宅基地

文章浏览阅读1.1k次。源码简介与安装说明:2021增强版短视频去水印源码 去水印微信小程序源码网站 去水印软件源码安装环境(需要材料):备案域名–服务器安装宝塔-安装 Nginx 或者 Apachephp5.6 以上-安装 sg11 插件小程序已自带解析接口,支持全网主流短视频平台,搭建好了就能用注:接口是公益的,那么多人用解析慢是肯定的,前段和后端源码已经打包,上传服务器之后在配置文件修改数据库密码。然后输入自己的域名,进入后台,创建小程序,输入自己的小程序配置即可安装说明:上传源码,修改data/_去水印机要增强版

verilog进阶语法-触发器原语_fdre #(.init(1'b0) // initial value of register (1-程序员宅基地

文章浏览阅读557次。1. 触发器是FPGA存储数据的基本单元2. 触发器作为时序逻辑的基本元件,官方提供了丰富的配置方式,以适应各种可能的应用场景。_fdre #(.init(1'b0) // initial value of register (1'b0 or 1'b1) ) fdce_osc (

嵌入式面试/笔试C相关总结_嵌入式面试笔试c语言知识点-程序员宅基地

文章浏览阅读560次。本该是不同编译器结果不同,但是尝试了g++ msvc都是先计算c,再计算b,最后得到a+b+c是经过赋值以后的b和c参与计算而不是6。由上表可知,将q复制到p数组可以表示为:*p++=*q++,*优先级高,先取到对应q数组的值,然后两个++都是在后面,该行运算完后执行++。在电脑端编译完后会分为text data bss三种,其中text为可执行程序,data为初始化过的ro+rw变量,bss为未初始化或初始化为0变量。_嵌入式面试笔试c语言知识点

57 Things I've Learned Founding 3 Tech Companies_mature-程序员宅基地

文章浏览阅读2.3k次。57 Things I've Learned Founding 3 Tech CompaniesJason Goldberg, Betashop | Oct. 29, 2010, 1:29 PMI’ve been founding andhelping run techn_mature

一个脚本搞定文件合并去重,大数据处理,可以合并几个G以上的文件_python 超大文本合并-程序员宅基地

文章浏览阅读1.9k次。问题:先讲下需求,有若干个文本文件(txt或者csv文件等),每行代表一条数据,现在希望能合并成 1 个文本文件,且需要去除重复行。分析:一向奉行简单原则,如无必要,绝不复杂。如果数据量不大,那么如下两条命令就可以搞定合并:cat a.txt >> new.txtcat b.txt >> new.txt……去重:cat new...._python 超大文本合并

支付宝小程序iOS端过渡页DFLoadingPageRootController分析_类似支付宝页面过度加载页-程序员宅基地

文章浏览阅读489次。这个过渡页是第一次打开小程序展示的,点击某个小程序前把手机的开发者->network link conditioner->enable & very bad network 就会在停在此页。比如《支付宝运动》这个小程序先看这个类的.h可以看到它继承于DTViewController点击左上角返回的方法- (void)back;#import "DTViewController.h"#import "APBaseLoadingV..._类似支付宝页面过度加载页

推荐文章

热门文章

相关标签