Ultralytics YOLO27:
Ultralytics 平台

使用 Ultralytics Platform 更快地训练 YOLO 模型

了解如何使用 Ultralytics Platform 更快地训练 YOLO 模型。这是一套端到端环境,旨在加快从数据到部署的进程。

ABAbirami Vina11 min read
使用 Ultralytics Platform 更快地训练 YOLO 模型

上周,Ultralytics 推出了 Ultralytics Platform,这是一个统一的工作空间,旨在简化团队构建、训练和部署计算机视觉模型的方式。你无需再周旋于多个工具之间,因为该平台将所有功能集中到一处。借助视觉 AI 模型,从创意到部署变得轻松无忧。

这至关重要,因为计算机视觉正迅速成为各行各业的核心组成部分。它为制造业检测、零售分析和自动导航等应用提供支持。

将这些具备视觉能力的应用转化为可靠系统,取决于模型训练的质量。模型训练是从标注数据中学习,使模型能够识别模式并做出准确预测的过程。通常,训练良好的模型能够带来更出色的模型性能,以及在真实应用中更可靠的结果。

然而,训练计算机视觉模型并不总是简单直接的过程。它涉及多个方面,例如设置环境、选择合适的计算资源、调整超参数,以及跟踪多个训练实验。当这些步骤分散在不同工具和系统中时,训练工作流很快就会变得复杂且难以管理。

Ultralytics Platform 通过将整个训练过程集中到一个统一的控制面板中,解决了这一问题。无论你是在云端、本地还是 Google Colab 中工作,都可以在同一处配置、运行和监控训练任务。

Ultralytics Platform 中的模型训练

图 1. Ultralytics Platform 中模型训练的一览(来源

本文将探讨 Ultralytics Platform 如何简化模型训练,以及它为何能让你的视觉 AI 项目更具优势。让我们开始吧!

计算机视觉模型通过模型训练从数据中学习#

在深入了解 Ultralytics Platform 上的模型训练工作原理之前,我们先退一步,了解模型训练是什么,以及其中包含哪些内容。

模型训练是计算机视觉模型学习解读视觉数据的过程。它会分析图像或视频,并逐步调整内部参数,以准确执行目标检测、图像分类和实例分割等视觉任务。随着时间推移,模型会直接从所看到的数据中学习模式,从而不断改进。

训练质量在很大程度上取决于数据集。你可以把数据集想象成教师用来训练学生的一套闪卡,其中每个示例都会帮助模型学会应该关注什么。

典型的计算机视觉数据集包含图像,通常采用 JPG 或 PNG 等格式,以及描述每张图像内容的标注。这些标注通常存储为 JSON 或 TXT 文件,为模型有效学习提供所需的标签和上下文。

但训练并不只是将数据输入模型。它包含多个关键步骤,从准备数据集,到选择合适的模型,再到配置训练过程。接下来,让我们仔细了解其中几个步骤。

了解数据集的准备方式#

你可能会觉得,只要有了数据集就可以立即开始训练模型,但在此之前还需要完成几个步骤,例如拆分数据集。

通常,数据集会拆分为三部分:训练集、验证集和测试集。训练图像用于教模型学习数据中的模式,而验证集则有助于在训练期间监控和微调性能。

测试集用于最后评估模型在全新、未见过的数据上的表现。这种设置有助于确保模型不会只是记住数据,而是能够泛化到真实场景。

为训练选择合适的模型#

训练前的另一个重要步骤是选择要使用的模型。在许多情况下,这意味着选择一个预训练模型。Ultralytics YOLO 模型已经在大型数据集上完成训练,并学习了通用视觉模式,因此是一个很好的起点。

使用这些模型就是迁移学习的一个例子:在现有知识的基础上,将模型调整到特定任务。这种方法有助于加快训练并改善结果,尤其是在数据有限的情况下。

这些模型也有不同的尺寸,每种尺寸都在速度和准确率之间提供了不同的权衡。较小的模型速度更快、效率更高,而较大的模型通常能提供更高的准确率,但需要更多计算资源。

为视觉模型配置训练参数#

准备好数据集并选定模型后,下一步就是配置模型的学习方式。

计算机视觉模型使用一组参数进行训练,这些参数决定模型如何处理数据、更新权重并随时间改进。这些设置会直接影响训练速度和最终准确率,因此对于取得良好结果至关重要。

以下是一些最常用的训练参数:

  • Epochs:表示模型在训练期间遍历整个数据集的次数。增加 epoch 数量可以让模型获得更多机会从数据中学习模式。
  • Batch size:表示单个训练步骤中同时处理的图像数量。较大的 batch size 可以加快训练,但需要更多内存。
  • Image size:指定训练期间使用的输入图像分辨率。更高的分辨率可能提高检测准确率,但会增加计算成本。
  • Learning rate:表示模型在训练期间更新内部参数的速率。过高或过低的值都可能导致训练不稳定。
  • Optimizer:负责根据每次训练迭代中计算出的误差更新模型参数的算法。

在基于 Ultralytics YOLO 的工作流中,这些配置通常定义在 YAML 文件中。该文件指定数据集路径、类别名称以及数据的拆分方式。它充当中央配置,告诉模型如何解读数据集。

从碎片化工作流到借助 Ultralytics Platform 实现统一体验#

我们刚刚讨论了训练计算机视觉模型所涉及的一些关键步骤,从准备数据集到选择模型,再到配置训练参数。在实践中,这一过程通常还会继续,包括跟踪实验、比较多次训练运行,并随着时间推移持续改进模型。

这些步骤很少在同一处完成。数据集可能在一个工具中准备,训练运行在另一个环境中执行,而实验跟踪则由单独的系统管理。随着项目发展,这种碎片化会增加复杂性、减慢迭代速度,也让一切更难保持井然有序。

Ultralytics Platform 将整个训练工作流集中到一个环境中,从而消除了这些复杂性。你无需在工具之间来回切换,就可以在同一处管理数据集、配置训练、运行实验和监控结果。

接下来,让我们深入了解 Ultralytics Platform 如何让模型训练更智能。

Ultralytics Platform 支持的训练选项#

在真实应用中,训练计算机视觉模型通常需要灵活的环境。根据数据集大小、模型复杂度和可用硬件,你可以选择在云端、本地计算机或外部笔记本环境中运行训练。

Ultralytics Platform 支持以下训练选项,以满足这些需求:

  • 云端训练:训练在由 Ultralytics 管理的云端图形处理单元 (GPUs) 上运行。此选项适合需要大量计算资源的大型数据集或复杂模型。
  • 本地训练:此选项使用计算机上的可用硬件,适合快速实验、测试配置或处理较小的数据集。对于更具扩展性的工作负载,你也可以在自己的云环境中运行训练,例如 AWS 或 GCP。
  • Google Colab:借助 Ultralytics Platform,你可以在 Google Colab 托管的笔记本环境中运行训练,实现灵活的基于浏览器的工作流,而无需配置本地计算机。

探索 Ultralytics Platform 上的云端训练#

对于计算机视觉项目而言,在本地或通过笔记本环境训练模型并不总是容易。

例如,在本地训练中,性能完全取决于你的硬件,这可能会限制计算能力并减慢实验速度。GPU 对高效训练至关重要,但并非所有环境都能可靠地访问 GPU。

Google Colab 等笔记本环境通过提供基于云端的 GPU 提供了另一种选择,但会话通常是临时的,可能中断较长时间的训练运行。随着数据集增大、工作流变得更加复杂,这些限制很快就会成为瓶颈,使训练速度变慢且可靠性降低。

Ultralytics Platform 通过云端训练选项解决了这一问题。它提供了一个开箱即用的环境,其中 Python 依赖项和 PyTorch 等框架已预先配置,让你无需额外设置即可开始训练。

你可以从一个控制面板启动训练任务并实时监控进度。这让你更容易专注于改进模型,而不是管理基础设施。

现在,让我们了解如何开始在 Ultralytics Platform 上进行云端训练。

步骤 1:选择基础模型#

第一步是为训练运行选择基础模型。你可以选择一个预训练的 Ultralytics YOLO 模型、克隆社区模型,或上传自己的预训练权重以满足自定义需求。

该平台支持所有 Ultralytics YOLO 模型,包括 Ultralytics YOLO26Ultralytics YOLO11Ultralytics YOLOv8Ultralytics YOLOv5,每个模型都有 nano (n)、small (s)、medium (m)、large (l) 和 extra-large (x) 等不同尺寸变体。不同模型变体在速度和准确率之间提供了不同权衡,你可以选择符合性能和计算需求的模型。

这些模型支持一系列 Ultralytics YOLO 用户已经熟悉的计算机视觉任务,包括目标检测、实例分割、图像分类、定向边界框 (OBB) 检测和姿态估计。

如果你有自定义需求,也可以上传自己的预训练模型权重。这意味着你可以直接在平台中继续训练或微调现有模型,例如目标检测器,而无需从头开始。如果你已经在其他地方训练过模型,或希望将模型调整到更具体的使用场景,这一功能尤其有用。

步骤 2:选择数据集#

下一步是选择用于训练的数据集。在 Ultralytics Platform 上,你可以使用 COCO 数据集等现有数据集、克隆社区数据集,或上传针对具体应用定制的自定义数据集。

该平台支持 Ultralytics YOLO 和 COCO 等常见标注格式。如果你计划直接在平台上标注自定义数据,也可以处理原始图像上传。

上传后,数据集会自动进行处理,包括验证、规范化、标签解析和统计信息生成。这样你可以立即了解数据情况,包括类别分布和数据集结构,并有助于确保一切准备就绪,可以开始训练。

数据集还会自动关联到训练运行,让你能够跟踪每个模型使用的数据,并确保不同实验之间的一致性。

步骤 3:配置训练参数#

选择数据集后,你可以配置控制模型学习方式的训练参数。这些参数包括 epoch 数、batch size、图像尺寸和训练日志的运行名称。其中许多参数会同时影响训练时长和模型的最终性能。

为了实现更精细的训练控制,该平台还允许你调整学习率、优化器类型、颜色增强设置和其他训练选项等高级参数。这些设置可以微调训练过程,从而提高模型准确率和稳定性。

步骤 4:选择 GPU#

接下来,你可以为训练运行选择 GPU 配置。选择合适的 GPU 取决于数据集大小、batch size、图像分辨率和模型复杂度等因素。找到合适的平衡,有助于在不使用过多计算资源的情况下保持训练高效。

Ultralytics Platform 提供 22 种 GPU 选项,具有不同级别的 VRAM(GPU 上的内存)和计算能力,可支持从小型任务到大规模工作负载的各种需求。

借助这些选项,你可以根据具体需求匹配硬件,无论是训练轻量级模型,还是处理大型复杂数据集。要了解更多信息,请查看 Ultralytics Platform 训练文档页面上的可用 GPU 列表。

Ultralytics Platform 提供的 GPU 选项

图 2. Ultralytics Platform 启用的部分 GPU 选项(来源

步骤 5:开始云端训练#

选择模型、数据集、训练参数和计算选项后,启动训练运行非常迅速。你可以从控制面板单击一次启动训练,平台会完成其余工作:初始化环境,并在选定的 GPU 上运行任务。

训练开始后,你可以直接在平台中监控进度。Train 选项卡提供关键指标的实时可见性,包括性能指标、损失曲线、系统使用情况和实时训练日志。

如果想进一步了解如何在本地训练,或如何将 Google Colab 与 Ultralytics Platform 结合使用,可以在官方 Ultralytics Platform 文档中查看更多教程。

在 Ultralytics Platform 上评估和比较模型#

训练完成后,下一步是评估模型的表现。在 Ultralytics Platform 上,你可以在一个项目中比较多次训练运行,清晰了解不同实验的表现。

开发模型时,通常会使用不同设置重复训练多次,例如更改学习率、batch size 或模型尺寸,以改善结果。每次运行都会生成略有不同的模型,因此比较它们非常重要。

项目充当集中枢纽,将模型和实验统一组织起来。你可以跟踪进度、查看结果,并专注于工作,无需在不同工具或视图之间切换。

在这一统一视图中,你还可以分析 precision、recall 和 mAP(平均精度)等关键性能指标,了解模型在不同类别上的表现。你也可以并排比较训练运行,以确定哪些配置能带来最佳结果。

为了补充这些指标,你可以使用 Predict 选项卡在示例图像或数据上快速测试训练好的模型,帮助你通过视觉验证性能并发现潜在问题。

借助这些洞察,你可以选择表现最佳的模型,该模型通常保存为 “best.pt” 检查点,然后进入下一阶段,无论是进一步评估、使用模型运行推理,还是通过平台部署模型。

在 Ultralytics Platform 上查看训练指标

图 3. 在 Ultralytics Platform 上查看指标的示例(来源

在 Ultralytics Platform 中估算训练成本#

在云端训练目标检测模型会产生计算成本,尤其是在使用高性能 GPU 时。为了让这一过程更加便捷,Ultralytics Platform 会在训练开始前提供成本估算。

它可以清晰展示预期用量,帮助你规划工作负载、管理预算,并在启动训练任务前避免意外支出。以下是如何在开始训练前查看预计成本。

训练时间如何估算#

为了准确估算成本,平台首先会计算单个训练 epoch 所需的时间。这取决于数据集大小、模型尺寸、图像分辨率、batch size 和所选 GPU 的速度等因素。

平台利用这些输入确定每个 epoch 的预计时间,并将其扩展到完整的训练运行。总时长通过汇总所有 epoch 的时间,再加上一小段启动开销来计算。

开销包括初始化环境、加载数据集和准备 GPU 等任务,从而确保估算反映完整的训练过程,而不仅仅是训练循环。

训练成本如何计算#

估算出总训练时间后,平台会根据所选 GPU 的小时费率将其转换为成本。

将训练时长与 GPU 定价结合起来,我们就能在运行开始前清楚估算其成本。

提前了解成本后,你可以轻松调整设置,例如微调训练参数或选择其他 GPU,从而更有效地平衡性能和成本。

在 Ultralytics Platform 中设置训练并估算成本

图 4. 在 Ultralytics Platform 中设置模型训练并估算成本(来源

使用 Ultralytics Platform 进行模型训练的主要优势#

到目前为止,我们已经介绍了训练计算机视觉模型所涉及的关键步骤,以及这些步骤如何在 Ultralytics Platform 上协同完成。

除了这些核心功能之外,平台还提供了能够增强训练工作流的其他能力。以下是使用 Ultralytics Platform 进行模型训练的一些主要优势:

  • 内置实验可复现性:每次训练运行都会自动记录完整配置,包括模型、数据集、参数和计算设置。这让你可以轻松重新查看实验,并可靠地复现结果。
  • 随时间变化的训练洞察:你不仅可以查看最终结果,还可以跟踪模型性能在各个训练周期中的变化,从而更好地了解模型在训练期间的行为。
  • 降低运维负担:平台在后台处理环境设置、依赖管理和基础设施,让你可以更专注于模型开发,减少在配置工作上的投入。
  • 集中管理实验:项目提供统一的位置来管理模型、数据集和训练运行,帮助你在工作流程日益复杂时保持实验井然有序。

要点总结#

训练是机器学习模型生命周期中最重要的阶段之一。它决定了模型识别和解读视觉数据的准确程度。

通过在同一环境中整合训练数据配置、监控、实验比较和成本估算,Ultralytics Platform 简化了构建高性能计算机视觉模型并为其部署做好准备的流程。

访问不断发展的社区和我们的 GitHub 代码仓库,进一步了解计算机视觉。如果你希望构建视觉解决方案,可以查看我们的许可选项。探索我们的解决方案页面,进一步了解制造业中的计算机视觉农业中的 AI所带来的优势。

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅