YOLOV8逐步分解(6)_模型训练初始设置之image size检测batch预设及dataloder初始化

本文主要是介绍YOLOV8逐步分解(6)_模型训练初始设置之image size检测batch预设及dataloder初始化,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

yolov8逐步分解(1)--默认参数&超参配置文件加载

yolov8逐步分解(2)_DetectionTrainer类初始化过程

yolov8逐步分解(3)_trainer训练之模型加载

YOLOV8逐步分解(4)_模型的构建过程

YOLOV8逐步分解(5)_模型训练初始设置之混合精度训练AMP

        接逐步分解(5),继续模型训练初始设置的讲解,本章将讲解image size检测、batch预设及dataloder初始代码。

1. image size代码

        # Check imgszgs = max(int(self.model.stride.max() if hasattr(self.model, 'stride') else 32), 32)         # grid size (max stride)self.args.imgsz = check_imgsz(self.args.imgsz, stride=gs, floor=gs, max_dim=1)

这段代码是用来处理输入图像的尺寸(imgsz)。它的作用:

1.1 gs = max(int(self.model.stride.max() if hasattr(self.model, 'stride') else 32), 32):

        计算出模型的最大 stride 值。

        如果模型有 stride 属性,就取它的最大值;否则默认为 32。

        这个 gs 变量代表了模型的网格大小(grid size),它是用于确定输入图像尺寸的一个重要参数。

1.2 self.args.imgsz = check_imgsz(self.args.imgsz, stride=gs, floor=gs, max_dim=1):

        代码调用了 check_imgsz() 函数,用于检查和设置输入图像的尺寸。

        self.args.imgsz 是用户传入的期望输入图像尺寸。

        check_imgsz() 函数会根据模型的 stride 值和其他参数,对 self.args.imgsz 进行调整和验证。

        具体来说:

                stride=gs: 使用计算出的网格大小作为 stride 参数。

                floor=gs: 确保输入图像尺寸是网格大小的倍数。

                max_dim=1: 限制输入图像的最大维度为 1。

        这段代码的目的是确保输入图像的尺寸与模型的特性(如 stride)匹配,以确保模型能够正确地处理输入数据。这有助于提高模型的性能和稳定性。

2. batch size设置

        # Batch sizeif self.batch_size == -1: #表示批量大小需要自动估计if RANK == -1:  # single-GPU only, estimate best batch sizeself.args.batch = self.batch_size = check_train_batch_size(self.model, self.args.imgsz, self.amp)#估计最佳批量大小else:SyntaxError('batch=-1 to use AutoBatch is only available in Single-GPU training. ''Please pass a valid batch size value for Multi-GPU DDP training, i.e. batch=16')

处理训练时的批量大小(batch size):

2.1 if self.batch_size == -1::

        这个条件检查是否需要自动估计批量大小。

        如果 self.batch_size 为 -1,表示需要自动估计最佳批量大小。

2.2 if RANK == -1:

        这个条件检查当前是否处于单 GPU 训练模式。

        如果是单 GPU 训练,才能使用自动估计批量大小的功能。

2.3 self.args.batch = self.batch_size = check_train_batch_size(self.model, self.args.imgsz, self.amp):

        在单 GPU 训练模式下,代码调用 check_train_batch_size() 函数来估计最佳批量大小。

        这个函数会根据模型、输入图像尺寸和是否启用混合精度训练,来计算出最佳的批量大小。

        计算结果会赋值给 self.args.batch 和 self.batch_size。

2.4 如果不是单 GPU 训练模式(即分布式训练),就会抛出一个 SyntaxError 异常。

        异常信息提示用户,在分布式训练时不能使用自动批量大小估计功能,需要手动设置一个有效的批量大小。

        这段代码的目的是尽可能自动地估计出最佳的批量大小,以提高训练的效率和性能。但这个功能只在单 GPU 训练模式下可用,在分布式训练中需要手动设置批量大小。

3. dataloader 初始化

        # Dataloadersbatch_size = self.batch_size // max(world_size, 1)self.train_loader = self.get_dataloader(self.trainset, batch_size=batch_size, rank=RANK, mode='train')#获取训练集if RANK in (-1, 0):self.test_loader = self.get_dataloader(self.testset, batch_size=batch_size * 2, rank=-1, mode='val') #获取测试集self.validator = self.get_validator() #创建验证器(validator),用于评估模型在验证数据集上的性能。metric_keys = self.validator.metrics.keys + self.label_loss_items(prefix='val')self.metrics = dict(zip(metric_keys, [0] * len(metric_keys)))  # TODO: init metrics for plot_results()?self.ema = ModelEMA(self.model)if self.args.plots and not self.args.v5loader: #如果 self.args.plots 为真且 self.args.v5loader 为假self.plot_training_labels() #绘制训练标签的图表

设置和获取训练集和测试集的数据加载器(dataloader):

3.1 batch_size = self.batch_size // max(world_size, 1):

        这一行代码计算出每个进程(process)使用的批量大小。

        它将 self.batch_size 除以 world_size (分布式训练时的进程数)或 1(单机训练时)。

        这样做是为了确保在分布式训练时,每个进程使用的批量大小是合理的。

3.2 self.train_loader = self.get_dataloader(self.trainset, batch_size=batch_size, rank=RANK, mode='train'):

        这一行代码通过调用 self.get_dataloader() 函数,获取训练数据集的数据加载器。

        self.trainset 是训练数据集,batch_size 是计算出的批量大小,rank 是当前进程的序号(在分布式训练时使用)。

        mode='train' 表示这是用于训练的数据加载器。

3.3 if RANK in (-1, 0)::

        这个条件检查当前是否处于单机训练模式或主进程(rank 为 0)。

        只有在这些情况下,才会执行以下操作。

3.4 self.test_loader = self.get_dataloader(self.testset, batch_size=batch_size * 2, rank=-1, mode='val'):

        这一行代码获取验证数据集的数据加载器。

        self.testset 是验证数据集,批量大小是训练批量大小的两倍,rank 设置为 -1 表示不参与分布式训练。

        mode='val' 表示这是用于验证的数据加载器。

3.5 self.validator = self.get_validator():

        这一行代码创建了一个验证器(validator)对象,用于评估模型在验证数据集上的性能。

3.6 metric_keys = self.validator.metrics.keys + self.label_loss_items(prefix='val'):

        这一行代码获取验证阶段需要的所有度量指标的键(key)。

3.7 self.validator.metrics.keys 是验证器定义的度量指标,self.label_loss_items(prefix='val') 是验证阶段的标签损失项。

3.8 self.metrics = dict(zip(metric_keys, [0] * len(metric_keys))):

        这一行代码初始化了所有度量指标的值为 0。

3.9 self.ema = ModelEMA(self.model):

        这一行代码创建了一个指数移动平均(EMA)模型,用于在训练过程中保存模型的滚动平均值。

3.10 if self.args.plots and not self.args.v5loader: self.plot_training_labels():

        如果需要绘制训练标签的图表,并且不使用 v5 格式的数据加载器,就会调用 self.plot_training_labels() 函数。

        这段代码的主要目的是设置训练集和验证集的数据加载器,创建验证器,初始化度量指标,以及设置 EMA 模型等。这些都是训练模型时的常见操作。

这篇关于YOLOV8逐步分解(6)_模型训练初始设置之image size检测batch预设及dataloder初始化的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1008957

相关文章

Java的IO模型、Netty原理解析

《Java的IO模型、Netty原理解析》Java的I/O是以流的方式进行数据输入输出的,Java的类库涉及很多领域的IO内容:标准的输入输出,文件的操作、网络上的数据传输流、字符串流、对象流等,这篇... 目录1.什么是IO2.同步与异步、阻塞与非阻塞3.三种IO模型BIO(blocking I/O)NI

PyCharm如何设置新建文件默认为LF换行符

《PyCharm如何设置新建文件默认为LF换行符》:本文主要介绍PyCharm如何设置新建文件默认为LF换行符问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录PyCharm设置新建文件默认为LF换行符设置换行符修改换行符总结PyCharm设置新建文件默认为LF

基于Flask框架添加多个AI模型的API并进行交互

《基于Flask框架添加多个AI模型的API并进行交互》:本文主要介绍如何基于Flask框架开发AI模型API管理系统,允许用户添加、删除不同AI模型的API密钥,感兴趣的可以了解下... 目录1. 概述2. 后端代码说明2.1 依赖库导入2.2 应用初始化2.3 API 存储字典2.4 路由函数2.5 应

Linux上设置Ollama服务配置(常用环境变量)

《Linux上设置Ollama服务配置(常用环境变量)》本文主要介绍了Linux上设置Ollama服务配置(常用环境变量),Ollama提供了多种环境变量供配置,如调试模式、模型目录等,下面就来介绍一... 目录在 linux 上设置环境变量配置 OllamPOgxSRJfa手动安装安装特定版本查看日志在

Spring组件初始化扩展点BeanPostProcessor的作用详解

《Spring组件初始化扩展点BeanPostProcessor的作用详解》本文通过实战案例和常见应用场景详细介绍了BeanPostProcessor的使用,并强调了其在Spring扩展中的重要性,感... 目录一、概述二、BeanPostProcessor的作用三、核心方法解析1、postProcessB

Ubuntu中Nginx虚拟主机设置的项目实践

《Ubuntu中Nginx虚拟主机设置的项目实践》通过配置虚拟主机,可以在同一台服务器上运行多个独立的网站,本文主要介绍了Ubuntu中Nginx虚拟主机设置的项目实践,具有一定的参考价值,感兴趣的可... 目录简介安装 Nginx创建虚拟主机1. 创建网站目录2. 创建默认索引文件3. 配置 Nginx4

如何关闭 Mac 触发角功能或设置修饰键? mac电脑防止误触设置技巧

《如何关闭Mac触发角功能或设置修饰键?mac电脑防止误触设置技巧》从Windows换到iOS大半年来,触发角是我觉得值得吹爆的MacBook效率神器,成为一大说服理由,下面我们就来看看mac电... MAC 的「触发角」功能虽然提高了效率,但过于灵敏也让不少用户感到头疼。特别是在关键时刻,一不小心就可能触

Nginx配置系统服务&设置环境变量方式

《Nginx配置系统服务&设置环境变量方式》本文介绍了如何将Nginx配置为系统服务并设置环境变量,以便更方便地对Nginx进行操作,通过配置系统服务,可以使用系统命令来启动、停止或重新加载Nginx... 目录1.Nginx操作问题2.配置系统服android务3.设置环境变量总结1.Nginx操作问题

C#集成DeepSeek模型实现AI私有化的流程步骤(本地部署与API调用教程)

《C#集成DeepSeek模型实现AI私有化的流程步骤(本地部署与API调用教程)》本文主要介绍了C#集成DeepSeek模型实现AI私有化的方法,包括搭建基础环境,如安装Ollama和下载DeepS... 目录前言搭建基础环境1、安装 Ollama2、下载 DeepSeek R1 模型客户端 ChatBo

grom设置全局日志实现执行并打印sql语句

《grom设置全局日志实现执行并打印sql语句》本文主要介绍了grom设置全局日志实现执行并打印sql语句,包括设置日志级别、实现自定义Logger接口以及如何使用GORM的默认logger,通过这些... 目录gorm中的自定义日志gorm中日志的其他操作日志级别Debug自定义 Loggergorm中的