当前位置:   article > 正文

目标检测:yolov7训练自己的数据集,新手小白也能学会训练模型,一看就会

yolov7训练

目录

1. 环境配置

2. 数据集获取

2.1 网上搜索公开数据集

2.2 自制数据集

2.2.1 Labelimg安装

2.2.2 Labelimg使用

2.3 数据集转换及划分

2.3.1 数据集VOC格式转yolo格式

2.3.2 数据集划分

2.3.3 添加数据集列表

3. 训练模型

3.1 创建data.yaml

3.2 训练模型

4. 模型测试

5. 可视化界面


训练自己的数据集分为4部分,先配置环境,再获取制作自己的数据集,然后修改配置训练,最后验证训练结果,可选择将结果进行可视化界面展示。yolov7训练起来较为简单,跟yolov5相差不多,只需要多加一步将数据集所有的图片导入文本之中。如果有其他目标检测的数据集理论上可以直接拿来用,从第3训练模型开始看,新手小白0基础建议一步一步跟着来,哪里看不懂的或者遇到哪有问题可以评论区交流或者私信问~

1. 环境配置

在训练yolov7模型前环境必须配置完成,还不会配置环境的可以看我的这篇博客

深度学习目标检测:yolov7环境配置,适合0基础小白,超详细_yolov7 roc配置-CSDN博客文章浏览阅读779次,点赞21次,收藏9次。点击鼠标右键yolov7文件夹通过pycharm打开,打开后需要配置虚拟环境,点击file-settings,点击project:yolov7-main,点击python interpreter,点击右边add....,下载完之后运行安装,建议安装到默认路径,所以C盘需要留有20G以上的存储空间,一直点击下一步,直到出现这个界面,不要点击精简,选择自定义,然后全部勾选再一直下一步即可。下载完之后安装,一直点下一步,遇到选择路径 修改路径到D盘或者其它除C盘,再遇到勾选的选项全部勾选就可以。_yolov7 roc配置https://blog.csdn.net/qq_67105081/article/details/139262362?spm=1001.2014.3001.5502

环境配置完验证之后就可以获取自己的数据集

2. 数据集获取

数据集可以使用网上公开的跟自己研究相契合的数据集,或者是搜索/拍摄自己研究所需要的图片进行标注制作成数据集,这里两种方法都详细介绍一下

2.1 网上搜索公开数据集

可以在搜索引擎上搜索或者在公开数据集的网站上搜索关键词,使用到的公开数据集网站为kaggleKaggle: Your Machine Learning and Data Science CommunityKaggle is the world’s largest data science community with powerful tools and resources to help you achieve your data science goals.https://www.kaggle.com/比如这里做一个安全帽检测的研究,就可以在搜索框输入安全帽的英文(因为是英文网站,都需要翻译成英文后搜索)Safety helmet

搜索后就可以找到相关的内容,点击datasets筛选数据集,下载几个看一下数据集是否为目标检测的数据格式,一般文件夹为JPEGImages和Annotations包含这两个就可以使用

点开一个后点击download即可下载。

若是下载到分割数据集,即json格式的标注可以看我的这篇文章转为txt,其他数据格式转换也可以私聊定制https://blog.csdn.net/qq_67105081/article/details/138123877https://blog.csdn.net/qq_67105081/article/details/138123877

2.2 自制数据集

自制数据集需要先获取一定数量的目标图片,可以拍摄或者下载,图片足够之后使用标注工具Labelimg进行标注

2.2.1 Labelimg安装

使用Labelimg建议使用python3.10以下的环境,这里创建一个python3.8的虚拟环境,不会创建的可以去环境配置的文章下学习

conda create -n labelimg python=3.8

这里创建完之后进入labelimg环境

conda activate labelimg

进入labelimg环境之后通过pip下载labelimg(需要关闭加速软件)

pip install labelimg -i https://pypi.tuna.tsinghua.edu.cn/simple

安装完成之后就可以使用

2.2.2 Labelimg使用

在使用labelimg之前,需要准备好数据集存放位置,这里推荐创建一个大文件夹为data,里面有JPEGImages、Annotations和classes.txt,其中JPEGImages文件夹里面放所有的图片,Annotations文件夹是将会用来对标签文件存放,classes.txt里存放所有的类别,每种一行

classes.txt里存放所有的类别,可以自己起名,需要是英文,如果有空格最好用下划线比如no_hat

上述工作准备好之后,在labelimg环境中cd到data目录下,如果不是在c盘需要先输入其他盘符+:

例如d: 回车之后再输入文件路径,接着输入以下命令打开labelimg

labelimg JPEGImages classes.txt

打开软件后可以看到左侧有很多按钮,open dir是选择图片文件夹,上面选过了

点击change save dir 切换到Annotations目录之中,点击save下面的图标切换到pascal voc格式

切换好之后点击软件上边的view,将 Auto Save mode(切换到下一张图会自动保存标签)和Display Labels(显示标注框和标签) 保持打开状态。

常用快捷键:

A:切换到上一张图片

D:切换到下一张图片

W:调出标注十字架

del :删除标注框

例如,按下w调出标注十字架,标注完成之后选择对应的类别,这张图全部标注完后按d下一张

所有图像标注完成后数据集即制作完成。

2.3 数据集转换及划分

2.3.1 数据集VOC格式转yolo格式

暂时还没有数据集可以先点击下载安全帽检测数据跟着本文进行训练。

如何查看自己数据集格式,打开Annotations文件夹,如果看到文件后缀为.xml,则为VOC格式,如果文件后缀为.txt则为yolo格式,后缀名看不到请搜索 如何显示文件后缀名。yolov7训练需要转为yolo格式训练,转换代码如下:

  1. import xml.etree.ElementTree as ET
  2. import pickle
  3. import os
  4. from os import listdir, getcwd
  5. from os.path import join
  6. def convert(size, box):
  7. x_center = (box[0] + box[1]) / 2.0
  8. y_center = (box[2] + box[3]) / 2.0
  9. x = x_center / size[0]
  10. y = y_center / size[1]
  11. w = (box[1] - box[0]) / size[0]
  12. h = (box[3] - box[2]) / size[1]
  13. return (x, y, w, h)
  14. def convert_annotation(xml_files_path, save_txt_files_path, classes):
  15. xml_files = os.listdir(xml_files_path)
  16. print(xml_files)
  17. for xml_name in xml_files:
  18. print(xml_name)
  19. xml_file = os.path.join(xml_files_path, xml_name)
  20. out_txt_path = os.path.join(save_txt_files_path, xml_name.split('.')[0] + '.txt')
  21. out_txt_f = open(out_txt_path, 'w')
  22. tree = ET.parse(xml_file)
  23. root = tree.getroot()
  24. size = root.find('size')
  25. w = int(size.find('width').text)
  26. h = int(size.find('height').text)
  27. for obj in root.iter('object'):
  28. difficult = obj.find('difficult').text
  29. cls = obj.find('name').text
  30. if cls not in classes or int(difficult) == 1:
  31. continue
  32. cls_id = classes.index(cls)
  33. xmlbox = obj.find('bndbox')
  34. b = (float(xmlbox.find('xmin').text), float(xmlbox.find('xmax').text), float(xmlbox.find('ymin').text),
  35. float(xmlbox.find('ymax').text))
  36. # b=(xmin, xmax, ymin, ymax)
  37. print(w, h, b)
  38. bb = convert((w, h), b)
  39. out_txt_f.write(str(cls_id) + " " + " ".join([str(a) for a in bb]) + '\n')
  40. if __name__ == "__main__":
  41. # 需要转换的类别,需要一一对应
  42. classes1 = ['hat','nohat']
  43. # 2、voc格式的xml标签文件路径
  44. xml_files1 = r'f:\data\Annotations'
  45. # 3、转化为yolo格式的txt标签文件存储路径
  46. save_txt_files1 = r'f:\data\labels'
  47. convert_annotation(xml_files1, save_txt_files1, classes1)

需要自行将类别以及文件路径替换,这里顺序要记住,文件夹也对应替换,不知道有哪些类别可以看这篇博客统计标注文件xml文件类别-CSDN博客

2.3.2 数据集划分

训练自己的yolov7检测模型,数据集需要划分为训练集、验证集,这里提供一个参考代码,划分比例为8:2(这里不再划分测试集),也可以按照自己的比例划分修改代码,三者加起来为1即可

  1. import os
  2. import shutil
  3. import random
  4. random.seed(0)
  5. def split_data(file_path,xml_path, new_file_path, train_rate, val_rate, test_rate):
  6. each_class_image = []
  7. each_class_label = []
  8. for image in os.listdir(file_path):
  9. each_class_image.append(image)
  10. for label in os.listdir(xml_path):
  11. each_class_label.append(label)
  12. data=list(zip(each_class_image,each_class_label))
  13. total = len(each_class_image)
  14. random.shuffle(data)
  15. each_class_image,each_class_label=zip(*data)
  16. train_images = each_class_image[0:int(train_rate * total)]
  17. val_images = each_class_image[int(train_rate * total):int((train_rate + val_rate) * total)]
  18. test_images = each_class_image[int((train_rate + val_rate) * total):]
  19. train_labels = each_class_label[0:int(train_rate * total)]
  20. val_labels = each_class_label[int(train_rate * total):int((train_rate + val_rate) * total)]
  21. test_labels = each_class_label[int((train_rate + val_rate) * total):]
  22. for image in train_images:
  23. print(image)
  24. old_path = file_path + '/' + image
  25. new_path1 = new_file_path + '/' + 'train' + '/' + 'images'
  26. if not os.path.exists(new_path1):
  27. os.makedirs(new_path1)
  28. new_path = new_path1 + '/' + image
  29. shutil.copy(old_path, new_path)
  30. for label in train_labels:
  31. print(label)
  32. old_path = xml_path + '/' + label
  33. new_path1 = new_file_path + '/' + 'train' + '/' + 'labels'
  34. if not os.path.exists(new_path1):
  35. os.makedirs(new_path1)
  36. new_path = new_path1 + '/' + label
  37. shutil.copy(old_path, new_path)
  38. for image in val_images:
  39. old_path = file_path + '/' + image
  40. new_path1 = new_file_path + '/' + 'val' + '/' + 'images'
  41. if not os.path.exists(new_path1):
  42. os.makedirs(new_path1)
  43. new_path = new_path1 + '/' + image
  44. shutil.copy(old_path, new_path)
  45. for label in val_labels:
  46. old_path = xml_path + '/' + label
  47. new_path1 = new_file_path + '/' + 'val' + '/' + 'labels'
  48. if not os.path.exists(new_path1):
  49. os.makedirs(new_path1)
  50. new_path = new_path1 + '/' + label
  51. shutil.copy(old_path, new_path)
  52. for image in test_images:
  53. old_path = file_path + '/' + image
  54. new_path1 = new_file_path + '/' + 'test' + '/' + 'images'
  55. if not os.path.exists(new_path1):
  56. os.makedirs(new_path1)
  57. new_path = new_path1 + '/' + image
  58. shutil.copy(old_path, new_path)
  59. for label in test_labels:
  60. old_path = xml_path + '/' + label
  61. new_path1 = new_file_path + '/' + 'test' + '/' + 'labels'
  62. if not os.path.exists(new_path1):
  63. os.makedirs(new_path1)
  64. new_path = new_path1 + '/' + label
  65. shutil.copy(old_path, new_path)
  66. if __name__ == '__main__':
  67. file_path = r"f:\data\JPEGImages"
  68. txt_path = r'f:\data\labels'
  69. new_file_path = r"f:\VOCdevkit"
  70. split_data(file_path,txt_path, new_file_path, train_rate=0.8, val_rate=0.2, test_rate=0.2)

在划分之后,想要训练yolov7的数据集还需要将数据集的路径添加入txt中供训练数据读取

2.3.3 添加数据集列表

这里需要添加刚才划分的训练集、验证集路径至txt文本中保存,代码如下

  1. # importing the os Library
  2. import os
  3. train_list = r'f:/VOCdevkit/train/images/'
  4. val_list = r'f:/VOCdevkit/val/images/'
  5. path_list1 = r'f:/VOCdevkit/train_list.txt'
  6. path_list2 = r'f:/VOCdevkit/val_list.txt'
  7. def findfiles(path,path_list):
  8. # 首先遍历当前目录所有文件及文件夹
  9. file_list = os.listdir(path)
  10. # 循环判断每个元素是否是文件夹还是文件,是文件夹的话,递归
  11. for file in file_list:
  12. # 利用os.path.join()方法取得路径全名,并存入cur_path变量,否则每次只能遍历一层目录
  13. cur_path = os.path.join(path, file)
  14. # 判断是否是文件夹
  15. with open(path_list,'a') as f:
  16. f.write(cur_path+'\n')
  17. f.close()
  18. if __name__ == '__main__':
  19. findfiles(train_list,path_list1)
  20. findfiles(val_list, path_list2)

3. 训练模型

需要下载源码,这里选择的是yolov7默认的main版本

不会下载源码的可以看我的这篇博客点此查看,也可以深度学习目标检测:yolov7环境配置,适合0基础小白,超详细_yolov7 roc配置-CSDN博客文章浏览阅读779次,点赞21次,收藏9次。点击鼠标右键yolov7文件夹通过pycharm打开,打开后需要配置虚拟环境,点击file-settings,点击project:yolov7-main,点击python interpreter,点击右边add....,下载完之后运行安装,建议安装到默认路径,所以C盘需要留有20G以上的存储空间,一直点击下一步,直到出现这个界面,不要点击精简,选择自定义,然后全部勾选再一直下一步即可。下载完之后安装,一直点下一步,遇到选择路径 修改路径到D盘或者其它除C盘,再遇到勾选的选项全部勾选就可以。_yolov7 roc配置https://blog.csdn.net/qq_67105081/article/details/139262362?spm=1001.2014.3001.5502,我这里把源码和预训练权重yolov7.pt和yolov7-tiny.pt一起打包上传了。

有了源码之后需要修改里面的参数,导入自己的数据集

3.1 创建data.yaml

在yolov7/data目录下(也就是本文所用的yolov7-main/data目录下)创建一个新的data.yaml文件,也可以是其他名字的例如hat.yaml文件,后缀需要为.yaml,内容如下

  1. train: f:/VOCdevkit/train_list.txt # train images (relative to 'path') 128 images
  2. val: f:/VOCdevkit/val_list.txt # val images (relative to 'path') 128 images
  3. nc: 2
  4. # Classes
  5. names: ['hat','nohat']

具体路径和类别自己替换,需要和上面数据集转换那里类别顺序一致。

3.2 训练模型

这是使用官方提供的预训练权重进行训练,使用yolov7.pt,训练较慢也可以使用yolov7-tiny.pt。

下载完成之后放入yolov7-main根目录中,建议点击上面链接下载,yolov7-tiny.pt权重文件不容易获取。打开train.py文件,修改方框中框选部分内容

其中weights为导入模型,这里修改为yolov7.pt或者其他模型,cdg为改为yolov7.yaml或者pt对应的yaml文件名,data改为data/data.yaml,修改为自己新建的文件名,epochs可以先设为10,能够正常训练并且保存结果再修改为100或者更多,batch-size根据自己的电脑性能设置大小,建议为2的n次方,可以多次修改找到最适合自己电脑的参数大小。

训练过程如图,耐心等待训练完成即可,训练完成后会生成best.pt权重文件,可以用来验证训练效果或者部署到可视化界面之中展示。

训练过程中遇到报错可以评论区留言,看到都会及时回复

4. 模型测试

找到之前训练的结果保存路径,打开一个detect.py文件,修改图中yolov7.pt为训练好的权重文件路径,如runs/train/exp4/weights/best.pt,然后将待检测图片或视频放入inference/images文件夹中

运行后就会得到预测模型结果

可以打开对应路径下查看预测的图片效果,模型就训练好啦~

5. 可视化界面

部分同学的需求是制作出一个可视化图形界面来展示实时预测的效果,yolov7的可视化界面可以私聊定制

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/笔触狂放9/article/detail/750967
推荐阅读
相关标签
  

闽ICP备14008679号