在yolov3上训练自己的数据集+jetsonnano上运行tiny-yolov3_jetson nano yolov3-程序员宅基地

技术标签： jetsonnano 深度学习 tiny-yolov3 yolov3

本篇文章主要是介绍一个完整快速的训练自定义目标的全过程，具体其中一些为什么另起一篇文章详细介绍

一、在PC机上实现yolov3

1.下载darknet工程

我们在github上下载其源码工程

git clone https://github.com/pjreddie/darknet.git

2.修改Makefile并编译出darknet

进入到下载好的darknet文件夹根目录下，修改Makefile中的前五行为

（因为我们在PC机上已经安装好了cuDNN、OPENCV以及1660显卡，所以需要设置上面的相关几行）

在darknet工程根目录下执行编译命令

make -j6

最终我们在darknet目录下编译出了可执行文件 darknet,即darknet安装完成

3.下载预训练模型

#下载预训练模型
wget https://pjreddie.com/media/files/yolov3.weights

#下载yolov3-tiny模型
wget https://pjreddie.com/media/files/yolov3-tiny.weights

#预训练权重文件
wget https://pjreddie.com/media/files/darknet53.conv.74

4.使用下载好的模型进行测试

测试图片检测

#标准模型检测
./darknet detect cfg/yolov3.cfg yolov3.weights data/dog.jpg

#tiny模型检测
./darknet detect cfg/yolov3-tiny.cfg yolov3-tiny.weights data/dog.jpg

测试摄像头实时视频(接入usb摄像头)

#标准的模型测试
./darknet detector demo cfg/coco.data cfg/yolov3.cfg yolov3.weights

#tiny模型测试
./darknet detector demo cfg/coco.data cfg/yolov3-tiny.cfg yolov3-tiny.weights

当我们在上面的命令如果出现 CUDA Error: out of memory ，只需要修改所使用的模型cfg文件

例如：yolov3.cfg文件

第七行中的 subdivisions=16 修改为 subdivisions=32

cfg中的

batch：是指一次输入多少图片到神经网络中来计算loss，并反向update gradients

subdivisions：它会让你的每一个batch不是一下子都丢到网络里。而是分成subdivision对应数字的份数，一份一份的跑完后，在一起打包算作完成一次iteration。这样会降低对显存的占用情况，因为本身我的1660显卡显存不是很大，才6G。如果设置这个参数为1的话就是一次性把所有batch的图片都丢到网络里，如果为2的话就是一次丢一半。如果使用默认16的话，就是说将batch分为16份但是显存装不下，所以设置为 32

从上面的测试中我们也可以看到，在执行命令后打印的网络层数tiny模型层数明显少于标准模型，且在测试图片后还会打印当前图片检测所花费的时间，tiny模型检测时间相比较短，所以tiny检测的精度与速度自然比不上标准模型，但是其提升了检测速度，降低了GPU硬件门槛

5.制作检测目标的 VOC2012数据集

5.1 准备图片集

这里我以公司一卡通为例子，采集拍摄了总共260张图片，分辨率为960*960，大概如下：

在 scripts 目录下创建如下的文件夹，将上面采集到260张图片放到JPEGImages目录下

我们首先要对采集到图片进行重命名排序，这里统一命名为 2020_000001.jpg ~2020_000260.jpg

写了一个简单的python小程序--modify_name.py对JPEGImages中的图片进行重命名排序，这里贴出来具体如下：

import os
import sys

#path为路径名，这里修改为 JPEGImages文件夹的绝对路径即可
path = '/xxx/xxx/xxx/darknet-master/scripts/VOCdevkit/VOC2012/JPEGImages'
i = 1

for filename in os.listdir(path):
    oldDirPath = os.path.join(path,filename)
    print(oldDirPath)
    fileName = os.path.splitext(filename)[0]
    fileType = os.path.splitext(filename)[1]
    newDirPath = os.path.join(path,'2020_'+str("%06d"%(i))+fileType)
    print(newDirPath)
    os.rename(oldDirPath, newDirPath)
    i += 1

5.2给图片打标签

这里给上面的图片集打标签需要借助到 labelImg 这一款软件，这个软件有linux版本和windows版本，具体的安装以及使用可以在网络上找到，这里就不详细说明，这里我们新建的标签为 hr_card

5.3指定数据集和测试集

我们做好的数据集要一部分作为训练集来训练模型,需要另一部分作为测试集来帮助我们验证模型的可靠性.因此首先要将所有的图像文件随机分配为训练集和测试集.

我们在ImageSets的Main文件夹下新建train.txt 和 val..txt 空白文件分别用于存放训练集的文件名列表和测试集的文件名列表.

使用如下的脚本--make_train_val.txt 用于生成训练集和测试机（这里我使用260张图片的210张用于训练集，50张用于验证集）

import os
from os import listdir, getcwd
from os.path import join

if __name__ == '__main__':
    source_folder = '/xx/xx/xx/darknet-master/scripts/VOCdevkit/VOC2012/JPEGImages/'              # 图片数据集的路径
    train_path    = '/xx/xx/xx/darknet-master/scripts/VOCdevkit/VOC2012/ImageSets/Main/train.txt' # 训练集路径
    val_path      = '/xx/xx/xx/darknet-master/scripts/VOCdevkit/VOC2012/ImageSets/Main/val.txt'   # 验证集路径

    file_list  = os.listdir(source_folder)       
    train_file = open(train_path, 'a')                 
    val_file   = open(val_path, 'a')   
    count      = 0               

    for file_obj in file_list:
        count += 1                
        file_name,file_extend=os.path.splitext(file_obj)
        if(count<211):
            train_file.write(file_name+'\n') # 前210个数据收录为训练集
        else :
            val_file.write(file_name+'\n') #剩下50张图片数据作为验证集
    train_file.close()
    val_file.close()

执行该脚本我们可以看到在train.val 中存在随机抽取的210个图片文件名，val.txt文件中有存放着50个图片文件名

5.4 指定训练集和测试集的实际路径和标签文件

修改 scripts文件夹下的 voc_label.py 文件来生成训练集和测试集的实际路径文件以及其对应的标签文件

数据集sets修改：我们生成的数据集为训练集和验证集且版本为2012版本

分类classes：因为我们当前只检测一种目标 "hr_card"，如果你的数据集中有标注多个目标，这里同样需要添加数量

将2012_train.txt 和 2012_val.txt中的所有数据路径输入到train.txt

执行voc_lable.py脚本，我们就生成了 scripts/2012_train.txt 、2012_val.txt 、train.txt三个文件，以及在数据集 scripts/VOCdevkit/VOC2012/labels 生成了每一个图片数据的标签文件

6.配置yolov3相关文件

6.1 修改 darknet-master/data/voc.names

这里添加自己目标类名，我这里只有一类，所以只需要一行，即

hr_card

6.2 修改darknet-master/cfg/voc.data

按照实际情况修改，这里我只有一类，训练集和测试集路径修改即可

6.3 修改darknet-master/cfg/中的 yolov3-tiny.cfg 或者 yolov3-voc.cfg

6.3.1 yolov3-tiny版本

tiny版本我们需要修改cfg目录下的yolov3-tiny.cfg文件

现在我们需要训练模型，不需要测试，所以将yolov3-tiny.cfg中的Testing下面的batch=1、subdivisions=1注释，释放Training下面的两行，并修改subdivisions=32,修改为32的原因前面已经说明，这里不再赘述

classes=1 ，因为我们只有一类

filters=3*(classes+5),因为我们的classes=1，所以filters=18

生成预训练模型

./darknet partial cfg/yolov3-tiny.cfg yolov3-tiny.weights yolov3-tiny.conv.15 15

训练模型

./darknet detector train cfg/voc.data cfg/yolov3-tiny.cfg yolov3-tiny.conv.15 | tee tiny_hr_card_train_log.txt

训练一段时间后，我们可以按‘ctrl+c’手动结束模型训练，然后可以在backup中找到相应的训练模型，这里我选择的训练模型为　yolov3-tiny_900.weights

训练结束后执行

我们需要修改yolov3-tiny.cfg，注释掉Training，启用Testing

执行如下命令实现实时检测我们自定义的目标

./darknet detector demo cfg/voc.data cfg/yolov3-tiny.cfg backup/yolov3-tiny_900.weights

接下来我们可以将上面训练的模型放到jetsonnano上去运行，有点类似于交叉编译的感觉，这样就不用在jetsonnano上去训练模型了，本身jetsonnano训练模型速度肯定比不上PC端的显卡。

这里我省事一点，不想重复修改上面的一些cfg文件，直接将目前的darknet-master文件夹进行打包，然后发送到jetsonnano上解压

在解压后的darknet-master文件中执行make clean，清除掉前面在pc端生成的一些x86架构上才能运行的执行文件，因为我们现在是在arm上跑，所以需要make clean，重新执行make生成arm架构的darknet等文件。

重新make之后我们直接执行上面的实时检测目标的命令即可实现了，如下图所示，已经能够实时检测我手里的这张卡了(虽然目前的帧率很低，fps大约在6左右，需要进一步的优化。。。)

6.3.2 yolov3版本

我们修改的cfg文件为yolov3-voc.cfg，其具体的修改记录如下：

这里的random表示多尺度训练开关，这个参数仅影响训练速度，当我们的GPU显存较小，我们可以考虑关闭多尺度训练，即random=0，classes和filters设置参数和前面tiny版本一致

模型训练命令，附带保存一些训练时的数据log，log可以用来生成训练相关曲线等便于分析优化：

./darknet detector train cfg/voc.data cfg/yolov3-voc.cfg scripts/darknet53.conv.74 | tee train_yolov3-voc.log

同理，训练一段时间后我们执行‘ctrl+c’结束模型训练，然后在backup中找到相应的模型，例如这里的：yolov3-voc_900.weights

然后我们修改yolov3-voc.cfg文件，和前面tiny一样，注释掉Training，启用Testing中的batch和subdivisions

摄像头实时监测自定义目标命令：

./darknet detector demo cfg/voc.data cfg/yolov3-voc.cfg backup/yolov3-voc_900.weights

可以在PC端实现实时检测自定义目标了

附录：

本文参考以下博客：

使用yolov3-tiny训练自己的图像数据以及在jetson Nano上的测试

本文链接：https://blog.csdn.net/zz531987464/article/details/104403128

原作者删帖不实内容删帖广告或垃圾文章投诉

智能推荐

paddle 复现 MobileNets_V2模型（只关注模型）_paddle mobilenet-程序员宅基地

文章浏览阅读305次。paddle 复现 MobileNets_V2模型（只关注模型）_paddle mobilenet

给定一个数字n，实现1^2+2^2+3^2+.....+n^2的总值，用递归来实现_给出一个n求2^1+2^2+2^3+……+2……n-程序员宅基地

文章浏览阅读5.5k次，点赞2次，收藏3次。public static int sumNumber(int i){ int sum=0; if(i==1){ sum=1; }else{ sum+=i*i+sumNumber(i-1); } return sum; }_给出一个n求2^1+2^2+2^3+……+2……n

Oracle 进程详解_oracle 进程是什么进行-程序员宅基地

文章浏览阅读1w次。Oracle 进程详解参与数据库活动的进程可以分成两大类，分别是用户进程和 Oracle 进程，而后者又可以分成服务进程（Server Process ）和后台进程（Background Process）。（本文地址：http://blog.sunansheng.com/2016/04/29/oracle-process/）1．用户进程Oracle 提供的若干管理工具是典型的用户进程，比如RMA_oracle 进程是什么进行

创建一个react项目-程序员宅基地

文章浏览阅读809次。一、创建一个react项目一、全局安装reactnpm install create-react-app -g二、在桌面创建一个react项目create-react-app ‘文件名’注：文件名中不能含有大写字母【name can no longer contain capital letters】如图：执行这一命令，会有提示信息，将安装react，react-dom，..._创建一个react项目

MySql报错only_full_group_by的解决办法-程序员宅基地

文章浏览阅读1.4k次。前段时间我在一个新环境里部署程序时遇到MySql报错only_full_group_by，之前已经遇到过一次同样的问题，当时没有总结经验，导致这次解决时耗费了不少时间，这里把本次的处理过程进行记录总结，同时分享给大家MySql数据库报错如下，从字面意思理解是select后面查询的字段没有出现在group by中com.mysql.jdbc.exceptions.jdbc4.MySQLSyntaxErrorException:Expression #2 of SELECT list is not in _mysql报错only_full_group_by的解决办法

ubuntu中idea无法进行中文输入_idea 中文输入 xubuntu-程序员宅基地

文章浏览阅读695次。unbunt中idea无法进行中文输入[????????????这一段都是废话，只是表达自己崩溃的情绪，大家可以直接忽略] 这个问题费了自己很长的时间，看了很多博客，按照博客上的许多方法都无法进行解决，快崩溃了。正准备把输入法换了，去卸载ibus的时候，看到有人说最好不要卸载，可能会导致 ubuntu_desktop的奔溃。这个提醒让我自己放弃了这个决定。便也思考，会不会是自己unbunt和idea所对应的版本_idea 中文输入 xubuntu

随便推点

Springboot引入jar包步骤_springboot手动添加jar包-程序员宅基地

文章浏览阅读434次。第一步：项目根目录下创建lib文件夹。_springboot手动添加jar包

如何在Linux上使用Bochs（转载的）_centos bochs ltdl_library_path not set.-程序员宅基地

文章浏览阅读1.1k次。如何在Linux上使用Bochs作者：王聪引言最近在做操作系统方面的研究，不得不去下一个虚拟机来用。由于我不使用Windows，所以选择很少了。因为在Linux上，差不多就只有两款好的虚拟机——Bochs和Qemu。这两个之中，Bochs是用C++编写，能在很多平台上使用，而且不论什么平台，它都不倚赖主机的指令系统，总是模拟x86。所以我选择了Bochs。但是，我惊_centos bochs ltdl_library_path not set.

Python内置的日志模块：logging用法详解_如何使用ython内置logging?-程序员宅基地

文章浏览阅读107次。Python提供了一个内置的日志模块logging，它简化了日志记录的过程，并提供了灵活的配置选项。函数进行基本的日志配置，然后使用不同的日志记录方法记录日志消息。此外，我们还介绍了一些高级功能，如将日志消息输出到文件、同时输出到控制台和文件，以及设置不同的日志处理器。除了基本的日志记录之外，logging模块还提供了一些高级功能，比如将日志消息输出到文件、同时输出到控制台和文件、设置不同的日志处理器等。在上面的示例中，我们将日志级别设置为DEBUG，这意味着所有级别的日志消息都将被记录。_如何使用ython内置logging?

网络服务（4）——以太网配置IP、网关_ifconfig配置ip和网关-程序员宅基地

文章浏览阅读5.6k次，点赞2次，收藏13次。buildroot/etc/network/interfaces自动分配IPauto eth0iface eth0 inet dhcp(当前使用的系统在配置了dhcp之后，如果获取不到IP，会影响到桌面显示)静态IPauto eth0iface eth0 inet staticaddress 192.168.0.232gateway 192.168.0.1netmask 255.255.255.0patchdiff --git a/buildroot/package/ifup_ifconfig配置ip和网关

利用html和css实现常见的布局_parent{display:flex;align-content:center}-程序员宅基地

文章浏览阅读233次。转载来源:https://segmentfault.com/a/1190000003931851单列布局水平居中水平居中的页面布局中最为常见的一种布局形式，多出现于标题，以及内容区域的组织形式，下面介绍四种实现水平居中的方法（注：下面各个实例中实现的是child元素的对齐操作，child元素的父_parent{display:flex;align-content:center}

什么是水平分表，垂直分表_水平分表和垂直分表-程序员宅基地

文章浏览阅读412次。水平分表把一个大表，拆分成多个小表，大表和小表的字段完全一致，只是小表的数据加一起才是大表的数据（如大表的资料有三个月的人员刷卡资料。小表分别会存一个月的刷卡资料）垂直分表把一个大表，拆分成多个小表。小表的字段总和（除id）等同于大表字段例如：大表字段为id,empno,chname,sex,age,dept则小表1的字段为id,empno,chname,dept小表2的字段为id,empno,sex,age..._水平分表和垂直分表