跳到主要内容

创建训练任务

这个功能解决什么问题

有了数据集之后,下一步是训练模型。VortLab 把整个配置过程收进一个对话框:选数据集版本、挑模型架构、调训练参数、选硬件,点一下就能开跑。任务类型由项目自动决定,你不需要纠结该训检测还是分割。

本页带你从打开对话框到点击「开始训练」,完成第一个训练任务的创建。

前置条件

开始之前,确认以下条件都已满足:

  • 项目下已创建数据集,并且已发布至少一个就绪(ready)版本。训练任务必须绑定一个就绪版本,这是为了保证训练输入可复现。
  • 你拥有 training:create(创建训练任务)权限。没有权限时「训练新模型」按钮不会显示。

创建入口

一共有三种方式打开训练创建对话框,最终都进入同一个表单,区别只在于是否预填内容:

  1. 从项目「训练」菜单(推荐):进入项目工作区,点左侧「训练」,再点右上角「训练新模型」。这是最常用的入口,适合从零开始配置。
  2. 从数据集版本:打开数据集详情的「版本」标签,找到任意就绪版本行,点该行的「训练」按钮。系统会自动把这一版预填进表单,省去下拉选择。
  3. 从已有模型版本(迁移学习):打开模型详情页,在版本行点 ⋯ 菜单里的「用此数据训练」。系统会预填该版本当时的超参数(模型架构、轮数、批次大小、学习率、图像尺寸、设备等),方便复现或微调。
训练创建对话框
图1:训练创建对话框全貌

操作步骤

以推荐的「项目训练菜单」入口为例:

  1. 进入训练菜单

    打开项目工作区,点左侧导航的「训练」。页面标题为「训练任务」,右上角能看到「训练新模型」按钮。

  2. 打开创建对话框

    点「训练新模型」,弹出对话框,标题同样是「训练新模型」,副标题「配置训练参数,开始模型训练」。

  3. 选择数据集版本(必填)

    在「数据集版本」下拉里选择一个就绪版本。列表只显示 ready 且未归档的版本,格式为 v{版本号} · {图片数} images。选好后下方会展示该版本的类别数、训练集、验证集、测试集样本量。

  4. 选择模型架构

    在「模型架构」下拉里挑一个,例如 YOLOv8 (Nano)、YOLO11 (Small)。架构列表按项目的任务类型(检测、分割、姿态、旋转框)自动过滤。

  5. 选择预训练模型(可选)

    「预训练模型」默认是「无(从头训练)」。想迁移学习就挑一个内置权重,选好后模型架构会跟着联动成该权重对应的架构。

  6. 设置训练参数

    填三个核心数字:训练轮数、批次大小、学习率。新手用默认值(100 / 16 / 0.01)就能跑起来。

  7. 选择设备类型

    在「设备类型」下拉里选 GPU、CPU 或华为昇腾 NPU。当前环境不可用的选项会标注「(不可用)」并禁用。详细说明见下方「关于训练设备」。

  8. (可选)展开高级设置

    点「高级设置」可调整矩形训练模式和图像尺寸。

  9. 点击开始训练

    检查无误后点底部的「开始训练」。任务创建成功后对话框关闭,左侧任务列表出现一条新任务,状态为「等待中」。

数据集版本是必填的

新训练任务必须绑定一个「就绪」状态的数据集版本。如果版本下拉为空,或者提示「该项目数据集暂无就绪版本」,请先去数据集详情页发布一个版本,再回来创建训练任务。

字段说明

核心字段

字段类型必填默认值说明
任务名称文本可选自动生成给训练任务起个名字。留空时系统自动生成,规则见下方提示。
数据集版本下拉必填训练输入的数据集版本,只显示就绪(ready)且未归档的版本。
模型架构下拉必填yolov8n模型网络结构,按项目任务类型自动过滤(检测、分割、姿态、旋转框)。
预训练模型下拉可选无(从头训练)迁移学习用的预训练权重。选「无」则从头训练。
训练轮数数字必填100整个数据集迭代多少遍。建议 100 到 300 轮。
批次大小数字必填16每次前向传播处理的图片数。GPU 显存不够时调小。
学习率数字必填0.01优化器步长。常用范围 0.001 到 0.01。
设备类型下拉必填cpu训练硬件:GPU、CPU 或华为昇腾 NPU。不可用选项会禁用。

高级设置字段

点对话框底部的「高级设置」条可展开:

字段类型必填默认值说明
矩形训练模式开关可选关闭开启后改用矩形训练(rect),适合非正方形图像。此时图像尺寸改为分别设置宽和高。
图像尺寸下拉可选640训练时图片缩放到的边长。可选 320 / 416 / 512 / 640 / 800 / 1024 / 1280。仅矩形训练关闭时显示。
图像宽度数字可选640矩形训练模式下图像缩放的宽度,步进为 8。
图像高度数字可选480矩形训练模式下图像缩放的高度,步进为 8。

设备相关字段

选不同设备时,下方会出现不同的附加配置:

  • GPU:「自动选择 GPU」开关(默认开)、「显存限制 (MB)」。关闭自动选择后,显示 GPU 卡多选网格,每张卡列出名称、已用/总计显存和推荐显存。
  • CPU:「CPU 核心数」(默认 8)。
  • 华为昇腾 NPU:「NPU 内存限制 (MB)」。
GPU 选择界面
图2:GPU 选择(含 GPU 卡列表)
高级设置展开
图3:高级设置展开

设备说明

关于训练设备
  • GPU:训练速度最快,需要 NVIDIA GPU 环境。默认开启「自动选择 GPU」,系统会分配最优资源。关闭后可手动勾选具体 GPU 卡,并设置显存上限。
  • CPU:无需 GPU,速度较慢,适合小数据集试验或环境验证。可设置使用的 CPU 核心数。
  • 华为昇腾 NPU:需要昇腾硬件环境,适合国产算力场景。可设置 NPU 内存限制。
  • 当前环境不支持的设备会标注「(不可用)」并禁用,无法选择。
GPU 自动选择

选择 GPU 时默认勾选「自动选择 GPU」,系统按资源情况分配最优 GPU,无需手动指定。如果机器上有多张卡且想固定用某几张,关掉自动选择后会出现 GPU 卡多选网格,逐张勾选即可。

任务名自动生成规则

留空任务名会自动生成

任务名称留空时,系统按以下规则生成:

{数据集名}-{任务类型标签}-{月日}-{当日序号}

  • 任务类型标签:Det(检测)、Seg(分割)、Pose(姿态)、OBB(旋转框)、Cls(分类)
  • 月日为两位月加两位日,例如 6 月 17 日写成 0617
  • 当日序号三位补零,从 001 开始递增

举例:数据集叫 工业缺陷,6 月 17 日当天第一次训练检测任务,自动生成的名字是 工业缺陷-Det-0617-001

结果

点击「开始训练」后:

  • 对话框关闭,提示「训练任务创建成功」。
  • 训练任务列表出现一条新任务,状态显示「等待中」。
  • 此时任务还没开跑。点任务列表里该任务右侧的 ▶ 按钮,或者选中任务后在详情区点「开始训练」,才会真正启动训练。

后续如何监控训练过程、查看指标曲线、注册产出的模型,请看下一页「查看训练进度与指标」。

常见问题

版本下拉为空怎么办

说明项目数据集还没有就绪版本。去数据集详情页的「版本」标签,手动发布一个版本。版本发布会把当前工作区的图片和标签做成一份不可变快照,训练任务绑定的就是这份快照。

模型架构列表为空

「模型架构」下拉显示「暂无可用架构」时,说明系统还没安装对应任务类型的内置模型。请联系管理员在全局设置里安装对应类型的模型权重。

不知道参数怎么填

第一次训练直接用默认值(100 轮、批次 16、学习率 0.01、图像 640)就能跑。跑完看指标曲线再决定要不要调参。批次大小最常调:显存报错就减半,跑得慢想加速就翻倍试试。