小白学习HigherHRNet代码_higherhrnet代码分析-程序员宅基地

技术标签：学习

代码源自：

HRNet/HigherHRNet-Human-Pose-Estimation: This is an official implementation of our CVPR 2020 paper "HigherHRNet: Scale-Aware Representation Learning for Bottom-Up Human Pose Estimation" (https://arxiv.org/abs/1908.10357) (github.com)

dist_train.py

共三个函数

1. 第一个parse_args：

def parse_args():

用于解析命令行参数。它使用argparse库来处理命令行参数，使您能够通过命令行在运行脚本时传递配置和选项。

以下是每个参数的解释：

--cfg: 实验配置文件名。这是一个必需的参数，您需要提供一个配置文件来指定训练实验的各种设置。
opts: 通过命令行修改配置选项。这允许您通过命令行添加额外的选项来修改配置文件中的设置。
--gpu: 用于多进程训练的GPU ID。
--world-size: 分布式训练中的节点数量。节点数量是指在分布式训练中参与训练的计算机节点的数量。每个节点都可以执行一部分训练工作，例如处理一部分的训练数据和更新模型的权重。节点数量越多，可以并行处理的工作量越大，从而加快整体的训练速度。
--dist-url: 用于设置分布式训练的URL。
--rank: 分布式训练中的节点排名。
args: 包含所有解析后的命令行参数的对象。

2. 第二个：main由三部分组成

def main():

1.解析命令行参数。它会从命令行中获取用户传递的参数和选项，并将其解析为一个名为 args 的对象。

  args = parse_args()
  update_config(cfg, args)
  cfg.defrost()
  cfg.RANK = args.rank
  cfg.freeze()

2.输出日志信息

    logger, final_output_dir, tb_log_dir = create_logger(
        cfg, args.cfg, 'train'
    )

    logger.info(pprint.pformat(args))
    logger.info(cfg)

3.解析GPU参数和分布式训练参数

    if args.gpu is not None:
        warnings.warn('You have chosen a specific GPU. This will completely '
                      'disable data parallelism.')
    if args.dist_url == "env://" and args.world_size == -1:
        args.world_size = int(os.environ["WORLD_SIZE"])
    args.distributed = args.world_size > 1 or cfg.MULTIPROCESSING_DISTRIBUTED
    ngpus_per_node = torch.cuda.device_count()
    if cfg.MULTIPROCESSING_DISTRIBUTED:
        # Since we have ngpus_per_node processes per node, the total world_size
        # needs to be adjusted accordingly
        args.world_size = ngpus_per_node * args.world_size
        # Use torch.multiprocessing.spawn to launch distributed processes: the
        # main_worker process function
        mp.spawn(
            main_worker,
            nprocs=ngpus_per_node,
            args=(ngpus_per_node, args, final_output_dir, tb_log_dir)
        )

3. 第三个：main_worker

def main_worker(

•    gpu, ngpus_per_node, args, final_output_dir, tb_log_dir

):

当解释这段代码时，我们可以将它分成以下几个主要部分来讲解：

1. 环境设置和模型构建：

设置 cuDNN 相关配置，包括性能优化和确定性计算等。
根据配置中的模型名称，调用相应的函数构建模型。

初始化分布式训练环境，包括分布式训练节点数量、分布式训练的进程与 GPU 分配等。

    cudnn.benchmark = cfg.CUDNN.BENCHMARK
    torch.backends.cudnn.deterministic = cfg.CUDNN.DETERMINISTIC
    torch.backends.cudnn.enabled = cfg.CUDNN.ENABLED

2. 模型并行和数据加载：

初始化模型，可能会使用 DistributedDataParallel 进行模型并行，或者是普通的 DataParallel。

创建数据加载器，准备数据用于训练。

train_loader = make_dataloader(
        cfg, is_train=True, distributed=args.distributed
    )

3. 训练循环：

从 begin_epoch 到 cfg.TRAIN.END_EPOCH 进行循环，对每个 epoch 进行训练。
在每个 epoch 内，调用 do_train() 函数进行实际的训练，包括前向传播、反向传播、参数更新等。
do_train()后续细讲

for epoch in range(begin_epoch, cfg.TRAIN.END_EPOCH):

4. 学习率调整和模型保存：

根据学习率调整策略，更新优化器的学习率。
根据训练效果，保存模型的检查点，包括当前状态和最好的状态。

在训练过程中，在特定的训练轮次（epoch）结束后，调用学习率调度器（lr_scheduler）的 step 方法来更新优化器的学习率。

      lr_scheduler.step()

5. 最终模型保存：

将最终模型的状态保存到文件中。

torch.save(model.module.state_dict(), final_model_state_file)

在每个部分内，代码执行的操作和目的都会有所不同。这个函数的目标是将分布式训练的各个环节组织起来，从模型构建、数据加载、训练循环、学习率调整到模型保存，确保训练过程顺利进行。

w32_512_adam_lr1e-3.yaml

配置文件：

dataset

INPUT_SIZE: 512 表示输入图像的大小。它指定了在训练或验证过程中，图像会被调整为 512x512 的尺寸。这个尺寸是模型接受的输入尺寸，用于训练和推断（预测）过程。在人体姿态估计任务中，输入图像的大小是一个重要的超参数。较大的输入图像尺寸可能会带来更多的细节信息，但同时也会增加计算开销。较小的输入图像尺寸可能会减少计算开销，但可能会丢失一些细节信息。

DATASET:
  INPUT_SIZE: 512

model

通道数是用来表示模型中不同层次的特征图（feature maps）的维度，它影响着模型的参数量、计算复杂度以及模型的性能。

MODEL:
 NUM_CHANNELS:
       - 32

本文链接：https://blog.csdn.net/m0_50752055/article/details/132188685

原作者删帖不实内容删帖广告或垃圾文章投诉

智能推荐

oracle 12c 集群安装后的检查_12c查看crs状态-程序员宅基地

文章浏览阅读1.6k次。安装配置gi、安装数据库软件、dbca建库见下：http://blog.csdn.net/kadwf123/article/details/784299611、检查集群节点及状态：[root@rac2 ~]# olsnodes -srac1 Activerac2 Activerac3 Activerac4 Active[root@rac2 ~]_12c查看crs状态

解决jupyter notebook无法找到虚拟环境的问题_jupyter没有pytorch环境-程序员宅基地

文章浏览阅读1.3w次，点赞45次，收藏99次。我个人用的是anaconda3的一个python集成环境，自带jupyter notebook，但在我打开jupyter notebook界面后，却找不到对应的虚拟环境，原来是jupyter notebook只是通用于下载anaconda时自带的环境，其他环境要想使用必须手动下载一些库：1.首先进入到自己创建的虚拟环境(pytorch是虚拟环境的名字)activate pytorch2.在该环境下下载这个库conda install ipykernelconda install nb__jupyter没有pytorch环境

国内安装scoop的保姆教程_scoop-cn-程序员宅基地

文章浏览阅读5.2k次，点赞19次，收藏28次。选择scoop纯属意外，也是无奈，因为电脑用户被锁了管理员权限，所有exe安装程序都无法安装，只可以用绿色软件，最后被我发现scoop，省去了到处下载XXX绿色版的烦恼，当然scoop里需要管理员权限的软件也跟我无缘了（譬如everything）。推荐添加dorado这个bucket镜像，里面很多中文软件，但是部分国外的软件下载地址在github，可能无法下载。以上两个是官方bucket的国内镜像，所有软件建议优先从这里下载。上面可以看到很多bucket以及软件数。如果官网登陆不了可以试一下以下方式。_scoop-cn

Element ui colorpicker在Vue中的使用_vue el-color-picker-程序员宅基地

文章浏览阅读4.5k次，点赞2次，收藏3次。首先要有一个color-picker组件 <el-color-picker v-model="headcolor"></el-color-picker>在data里面data() { return {headcolor: ’ #278add ’ //这里可以选择一个默认的颜色} }然后在你想要改变颜色的地方用v-bind绑定就好了，例如：这里的:sty..._vue el-color-picker

迅为iTOP-4412精英版之烧写内核移植后的镜像_exynos 4412 刷机-程序员宅基地

文章浏览阅读640次。基于芯片日益增长的问题，所以内核开发者们引入了新的方法，就是在内核中只保留函数，而数据则不包含，由用户（应用程序员）自己把数据按照规定的格式编写，并放在约定的地方，为了不占用过多的内存，还要求数据以根精简的方式编写。boot启动时，传参给内核，告诉内核设备树文件和kernel的位置，内核启动时根据地址去找到设备树文件，再利用专用的编译器去反编译dtb文件，将dtb还原成数据结构，以供驱动的函数去调用。firmware是三星的一个固件的设备信息，因为找不到固件，所以内核启动不成功。_exynos 4412 刷机

Linux系统配置jdk_linux配置jdk-程序员宅基地

文章浏览阅读2w次，点赞24次，收藏42次。Linux系统配置jdkLinux学习教程，Linux入门教程（超详细）_linux配置jdk

随便推点

matlab(4)：特殊符号的输入_matlab微米怎么输入-程序员宅基地

文章浏览阅读3.3k次，点赞5次，收藏19次。xlabel('\delta');ylabel('AUC');具体符号的对照表参照下图：_matlab微米怎么输入

C语言程序设计-文件(打开与关闭、顺序、二进制读写)-程序员宅基地

文章浏览阅读119次。顺序读写指的是按照文件中数据的顺序进行读取或写入。对于文本文件，可以使用fgets、fputs、fscanf、fprintf等函数进行顺序读写。在C语言中，对文件的操作通常涉及文件的打开、读写以及关闭。文件的打开使用fopen函数，而关闭则使用fclose函数。在C语言中，可以使用fread和fwrite函数进行二进制读写。‍ Biaoge 于2024-03-09 23:51发布阅读量：7 ️文章类型：【 C语言程序设计】在C语言中，用于打开文件的函数是____，用于关闭文件的函数是____。

Touchdesigner自学笔记之三_touchdesigner怎么让一个模型跟着鼠标移动-程序员宅基地

文章浏览阅读3.4k次，点赞2次，收藏13次。跟随鼠标移动的粒子以grid（SOP）为partical（SOP）的资源模板，调整后连接【Geo组合+point spirit（MAT)】，在连接【feedback组合】适当调整。影响粒子动态的节点【metaball(SOP)+force(SOP)】添加mouse in（CHOP)鼠标位置到metaball的坐标，实现鼠标影响。..._touchdesigner怎么让一个模型跟着鼠标移动

【附源码】基于java的校园停车场管理系统的设计与实现61m0e9计算机毕设SSM_基于java技术的停车场管理系统实现与设计-程序员宅基地

文章浏览阅读178次。项目运行环境配置：Jdk1.8 + Tomcat7.0 + Mysql + HBuilderX（Webstorm也行）+ Eclispe（IntelliJ IDEA,Eclispe,MyEclispe,Sts都支持）。项目技术：Springboot + mybatis + Maven +mysql5.7或8.0+html+css+js等等组成，B/S模式 + Maven管理等等。环境需要1.运行环境：最好是java jdk 1.8，我们在这个平台上运行的。其他版本理论上也可以。_基于java技术的停车场管理系统实现与设计

Android系统播放器MediaPlayer源码分析_android多媒体播放源码分析时序图-程序员宅基地

文章浏览阅读3.5k次。前言对于MediaPlayer播放器的源码分析内容相对来说比较多，会从Java-&amp;gt;Jni-&amp;gt;C/C++慢慢分析，后面会慢慢更新。另外，博客只作为自己学习记录的一种方式，对于其他的不过多的评论。MediaPlayerDemopublic class MainActivity extends AppCompatActivity implements SurfaceHolder.Cal..._android多媒体播放源码分析时序图

java 数据结构与算法 ——快速排序法-程序员宅基地

文章浏览阅读2.4k次，点赞41次，收藏13次。java 数据结构与算法 ——快速排序法_快速排序法