YOLO Vision 2026:
Назад к глоссарию Ultralytics

Gradient Descent

Изучи, как градиентный спуск оптимизирует модели машинного обучения, такие как Ultralytics YOLO26. Узнай о функциях потерь, обратном распространении ошибки и весах для повышения точности ИИ.

Gradient Descent — это фундаментальный итеративный алгоритм оптимизации, используемый для обучения моделей машинного обучения и нейронных сетей. Его основная функция заключается в минимизации loss function путем систематической настройки внутренних параметров модели, в частности model weights и смещений. Этот процесс можно представить в виде туриста, который пытается спуститься с горы в густом тумане; не имея возможности видеть основание, он ощущает уклон земли и делает шаг в направлении крутейшего спуска. В контексте machine learning (ML) «гора» представляет собой ландшафт ошибок, а «дно» — состояние, при котором предсказания модели наиболее точны. Этот метод оптимизации является движком современных прорывов в области artificial intelligence (AI), обеспечивая работу всего — от простой линейной регрессии до сложных архитектур глубокого обучения, таких как Ultralytics YOLO26.

Как работает градиентный спуск#

Эффективность Gradient Descent зависит от вычисления градиента — вектора, который указывает в направлении наибольшего роста loss function. Это вычисление обычно выполняется с помощью алгоритма backpropagation. После определения направления алгоритм обновляет веса в противоположном направлении для уменьшения ошибки. Размер шага определяется гиперпараметром, известным как learning rate. Поиск оптимального learning rate имеет решающее значение: слишком большой шаг может привести к тому, что модель проскочит минимум, в то время как слишком маленький шаг может сделать процесс обучения мучительно медленным, требуя чрезмерного количества epochs для сходимости. Для более глубокого понимания математики Khan Academy предоставляет урок по многомерному исчислению на эту тему.

Процесс повторяется итеративно, пока модель не достигнет точки, где ошибка минимизирована, что часто называют сходимостью. В то время как стандартный алгоритм вычисляет градиенты по всему набору training data, такие варианты, как Stochastic Gradient Descent (SGD), используют меньшие подмножества или отдельные примеры для ускорения вычислений и избежания локальных минимумов. Такая адаптируемость делает его подходящим для обучения крупномасштабных моделей на Ultralytics Platform, где эффективность и скорость имеют первостепенное значение.

Реальные приложения#

Градиентный спуск работает тихо в фоновом режиме почти любого успешного AI-решения, превращая необработанные данные в полезную информацию в различных отраслях.

  • Автономное вождение: При разработке autonomous vehicles модели должны обрабатывать визуальные данные для распознавания пешеходов, дорожных знаков и других автомобилей. Используя архитектуры object detection, такие как современный YOLO26, Gradient Descent минимизирует разницу между предсказанным положением объекта и его реальной позицией. Это гарантирует, что системы AI in automotive могут принимать молниеносные, спасающие жизни решения путем непрерывного уточнения своих внутренних карт дороги.
  • Медицинская диагностика: В здравоохранении medical image analysis опирается на глубокое обучение для обнаружения аномалий, таких как опухоли на МРТ-сканах. Используя Gradient Descent для оптимизации convolutional neural networks (CNNs), эти системы учатся с высокой точностью различать злокачественные и доброкачественные ткани. Это существенно помогает специалистам AI in healthcare, снижая количество ложноотрицательных результатов при критических диагнозах, что ведет к более ранним и точным планам лечения.

Разграничение похожих концепций#

Важно отличать Gradient Descent от тесно связанных терминов в глоссарии deep learning (DL), чтобы избежать путаницы во время разработки модели.

  • По сравнению с Backpropagation: Хотя о них часто говорят вместе, они выполняют разные роли в цикле обучения. Backpropagation — это метод, используемый для вычисления градиентов (определения направления уклона), тогда как Gradient Descent — это optimization algorithm, который использует эти градиенты для обновления весов (совершения шага). Backpropagation — это карта; Gradient Descent — это турист.
  • По сравнению с Adam Optimizer: Adam optimizer является продвинутой эволюцией Gradient Descent, которая использует адаптивные learning rate для каждого параметра. Это часто приводит к более быстрой сходимости, чем стандартный SGD. Он широко используется в современных фреймворках и является выбором по умолчанию для обучения таких моделей, как YOLO11 и YOLO26, благодаря своей надежности.
  • По сравнению с Loss Function: loss function (например, среднеквадратичная ошибка или перекрестная энтропия) измеряет, насколько плохо работает модель. Gradient Descent — это процесс, который улучшает эту производительность. Loss function дает оценку, а Gradient Descent предоставляет стратегию для улучшения этой оценки.

Пример кода на Python#

Хотя высокоуровневые библиотеки вроде ultralytics абстрагируют этот процесс во время обучения, вы можете увидеть механизм напрямую с помощью PyTorch. Следующий пример демонстрирует простой шаг оптимизации, где мы вручную обновляем тензор для минимизации значения.

import torch

# Create a tensor representing a weight, tracking gradients
w = torch.tensor([5.0], requires_grad=True)

# Define a simple loss function: (w - 2)^2. Minimum is at w=2.
loss = (w - 2) ** 2

# Backward pass: Calculate the gradient (slope) of the loss with respect to w
loss.backward()

# Perform a single Gradient Descent step
learning_rate = 0.1
with torch.no_grad():
    w -= learning_rate * w.grad  # Update weight: w_new = w_old - (lr * gradient)

print(f"Gradient: {w.grad.item()}")
print(f"Updated Weight: {w.item()}")  # Weight moves closer to 2.0

Понимание этих основ позволяет разработчикам устранять проблемы сходимости, эффективно настраивать гиперпараметры и использовать мощные инструменты, такие как Ultralytics Explorer, для визуализации того, как их наборы данных взаимодействуют с динамикой обучения моделей. Для тех, кто стремится эффективно развертывать эти оптимизированные модели, изучение quantization-aware training (QAT) может еще больше повысить производительность на периферийных устройствах.

Explore solutions

Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше
Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше
Real-time AI that works with your team

ИИ в робототехнике

Делай свои машины умнее с помощью моделей Ultralytics YOLO. ИИ машинного зрения в робототехнике обеспечивает автономную навигацию, восприятие, отслеживание объектов и управление в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в логистике

Оптимизируй логистику с помощью моделей Ultralytics YOLO. Vision AI позволяет инспектировать посылки, сортировать их, отслеживать транспортные средства и контролировать безопасность на складе в реальном времени.
Узнать больше
Real-time AI that works with your team

ИИ в розничной торговле

Переосмысли ритейл с помощью моделей Ultralytics YOLO. Vision AI расширяет возможности отслеживания запасов, мониторинга полок, управления очередями и более глубокого понимания клиентов.
Узнать больше
Real-time AI that works with your team

ИИ в здравоохранении

Создавай решения для здравоохранения с помощью моделей Ultralytics YOLO. ИИ для зрения в медицине ускоряет анализ медицинских изображений, делает диагностику более точной, а мониторинг пациентов — эффективнее.
Узнать больше
Real-time AI that works with your team

ИИ в производстве

Оптимизируй производство с помощью моделей Ultralytics YOLO. Vision AI управляет контролем качества, обнаружением дефектов, соблюдением СИЗ и автоматизацией сборочных линий.
Узнать больше
Real-time AI that works with your operation

ИИ в автомобильной отрасли

Применяй компьютерное зрение в автомобильной отрасли с моделями Ultralytics YOLO. ИИ для зрения повышает безопасность дорожного движения, помогает водителю и способствует автоматизации транспортных средств для создания более «умных» дорог.
Узнать больше
Real-time AI tailored to your operation

ИИ в сельском хозяйстве

Внедряй ИИ в «умное» сельское хозяйство с помощью моделей Ultralytics YOLO. Оптимизируй мониторинг посевов, отслеживание скота и точное земледелие для получения более высоких и «умных» урожаев.
Узнать больше

Давай строить будущее ИИ вместе!

Начни свой путь в будущее машинного обучения