首页
/ GCViT 项目使用教程

GCViT 项目使用教程

2024-10-10 00:52:31作者:魏侃纯Zoe

1. 项目目录结构及介绍

GCViT 项目的目录结构如下:

GCViT/
├── assets/
├── configs/
├── detection/
├── models/
├── schedulers/
├── scripts/
├── LICENSE
├── README.md
├── onnx_convert.py
├── onnx_test.py
├── requirements.txt
├── tensorboard.py
├── train.py
├── validate.py
└── validate.sh

目录介绍:

  • assets/: 存放项目相关的资源文件。
  • configs/: 存放项目的配置文件。
  • detection/: 存放与目标检测相关的代码和文件。
  • models/: 存放模型的定义和实现。
  • schedulers/: 存放训练调度器的相关代码。
  • scripts/: 存放一些辅助脚本。
  • LICENSE: 项目的许可证文件。
  • README.md: 项目的介绍和使用说明。
  • onnx_convert.py: 用于将模型转换为 ONNX 格式的脚本。
  • onnx_test.py: 用于测试 ONNX 模型的脚本。
  • requirements.txt: 项目依赖的 Python 包列表。
  • tensorboard.py: 用于 TensorBoard 可视化的脚本。
  • train.py: 项目的训练脚本。
  • validate.py: 用于模型验证的脚本。
  • validate.sh: 用于模型验证的 Shell 脚本。

2. 项目启动文件介绍

train.py

train.py 是 GCViT 项目的主要训练脚本。它负责加载配置、初始化模型、加载数据集并开始训练过程。

主要参数:

  • --config: 指定配置文件路径。
  • --data_dir: 指定数据集路径。
  • --batch-size: 指定每个 GPU 的批处理大小。
  • --amp: 启用自动混合精度训练。
  • --tag: 指定运行标签。
  • --model-ema: 启用模型指数移动平均。

使用示例:

python -m torch.distributed.launch --nproc_per_node <num-of-gpus> --master_port 11223 train.py \
    --config <config-file> --data_dir <imagenet-path> --batch-size <batch-size-per-gpu> --tag <run-tag> --model-ema

validate.py

validate.py 用于验证预训练模型的性能。它加载预训练模型并使用 ImageNet-1K 验证集进行评估。

主要参数:

  • --model: 指定模型名称。
  • --checkpoint: 指定预训练模型路径。
  • --data_dir: 指定数据集路径。
  • --batch-size: 指定批处理大小。

使用示例:

python validate.py --model <model-name> --checkpoint <checkpoint-path> --data_dir <imagenet-path> --batch-size <batch-size-per-gpu>

3. 项目的配置文件介绍

configs/ 目录

configs/ 目录下存放了项目的配置文件,这些配置文件定义了模型的超参数、数据集路径、训练参数等。

配置文件示例:

model:
  name: "GCViT-S"
  num_classes: 1000

data:
  train_dir: "path/to/imagenet/train"
  val_dir: "path/to/imagenet/val"

training:
  batch_size: 64
  epochs: 300
  optimizer: "adamw"
  lr: 0.001
  weight_decay: 0.05

配置文件的使用

train.py 中,通过 --config 参数指定配置文件路径,训练脚本会根据配置文件中的参数进行初始化和训练。

示例:

python train.py --config configs/gcvit_s.yaml

通过以上配置文件,可以灵活地调整模型的训练参数,以适应不同的训练需求。

登录后查看全文

项目优选

收起
kernelkernel
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
511
551
docsdocs
暂无描述
Markdown
852
5.69 K
ops-transformerops-transformer
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
1.05 K
2.49 K
kernelkernel
deepin linux kernel
C
33
16
pytorchpytorch
作为 Ascend for PyTorch 社区的核心组件,TorchNPU 是昇腾专为 PyTorch 打造的深度学习适配插件,使 PyTorch 框架能够直接调用昇腾 NPU,为开发者提供昇腾 AI 处理器的超强算力。
Python
839
1.28 K
ops-nnops-nn
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
847
1.7 K
ops-mathops-math
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
1.25 K
1.38 K
jiuwenswarmjiuwenswarm
JiuwenSwarm 是一款基于openJiuwen开发的智能AI Agent,它能够将大语言模型的强大能力,通过你日常使用的各类通讯应用,直接延伸至你的指尖。
Python
3.17 K
857
AscendNPU-IRAscendNPU-IR
AscendNPU-IR是基于MLIR(Multi-Level Intermediate Representation)构建的,面向昇腾亲和算子编译时使用的中间表示,提供昇腾完备表达能力,通过编译优化提升昇腾AI处理器计算效率,支持通过生态框架使能昇腾AI处理器与深度调优
C++
503
346
cann-learning-hubcann-learning-hub
CANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。
Jupyter Notebook
787
415