Neural Network (NN)
Изучи основы нейронных сетей. Узнай, как они обеспечивают работу AI, чем отличаются от глубокого обучения и как лежат в основе передовых моделей, таких как Ultralytics YOLO26.
Нейронная сеть (NN) — это вычислительная модель, лежащая в основе искусственного интеллекта (AI), предназначенная для распознавания закономерностей, интерпретации сенсорных данных и кластеризации информации. Вдохновленные биологическим строением человеческого мозга, эти сети состоят из взаимосвязанных узлов, или «нейронов», организованных в слои. В то время как биологический мозг использует химические сигналы для передачи информации через синапсы, цифровая нейронная сеть использует математические операции. Эти системы лежат в основе современных технологий машинного обучения (ML), позволяя компьютерам решать сложные задачи, такие как распознавание лиц, перевод языков и управление автономными транспортными средствами, без явного программирования каждого отдельного правила.
Нейронные сети и глубокое обучение#
Хотя эти термины часто используются как взаимозаменяемые, важно различать базовую нейронную сеть и глубокое обучение (DL). Основное различие заключается в глубине и сложности. Стандартная, или «мелкая», нейронная сеть может иметь всего один или два скрытых слоя между входом и выходом. Напротив, глубокое обучение использует «глубокие» нейронные сети с десятками и даже сотнями слоев. Такая глубина позволяет автоматически выполнять извлечение признаков, благодаря чему модель понимает иерархические закономерности: простые границы превращаются в формы, а формы — в узнаваемые объекты. Чтобы глубже разобраться в технических деталях, ознакомься с материалом MIT News о глубоком обучении и его развитии на основе базовых сетей.
Как обучаются нейронные сети#
Процесс «обучения» нейронной сети включает настройку внутренних параметров для минимизации ошибок. Данные поступают через входной слой, проходят через один или несколько скрытых слоев, где выполняются вычисления, и выходят через выходной слой в виде предсказания.
- Веса и смещения: каждое соединение между нейронами имеет «вес», определяющий силу сигнала. Во время обучения сеть корректирует эти веса на основе обучающих данных.
- Функции активации: чтобы определить, должен ли нейрон «сработать» или активироваться, сеть использует функцию активации, например ReLU или Sigmoid. Это вносит нелинейность и позволяет сети изучать сложные границы.
- Обратное распространение ошибки: когда сеть делает предсказание, она сравнивает результат с фактически правильным ответом. Если обнаруживается ошибка, алгоритм под названием обратное распространение ошибки передает сигнал в обратном направлении через сеть, чтобы точно настроить веса и со временем повысить точность.
- Оптимизация: такие алгоритмы, как стохастический градиентный спуск (SGD), помогают найти оптимальный набор весов для минимизации функции потерь. Подробнее об алгоритмах оптимизации в AWS можно прочитать здесь.
Практические применения#
Нейронные сети лежат в основе многих технологий, определяющих современную эпоху.
-
Компьютерное зрение: в области компьютерного зрения (CV) для анализа визуальных данных используются специализированные сети, называемые сверточными нейронными сетями (CNN). Продвинутые модели, такие как Ultralytics YOLO26, используют архитектуры глубоких нейронных сетей для обнаружения объектов в реальном времени. Эти системы имеют критическое значение для AI в сельском хозяйстве, где они отслеживают состояние посевов, а также для систем безопасности, в которых обнаруживаются аномалии.
-
Обработка естественного языка: для задач, связанных с текстом, такие архитектуры, как рекуррентные нейронные сети (RNN) и Transformer, произвели революцию в понимании машинами человеческого языка. Эти сети лежат в основе инструментов машинного перевода и виртуальных помощников. Влияние этих технологий можно увидеть в сфере AI в здравоохранении, где они помогают расшифровывать медицинские записи и анализировать истории болезни пациентов.
-
Прогнозная аналитика: компании используют нейронные сети для анализа временных рядов, чтобы прогнозировать цены на акции или потребность в запасах. IBM предлагает отличный обзор нейронных сетей в бизнес-аналитике.
Практическая реализация#
Современные программные библиотеки упрощают развертывание нейронных сетей, избавляя от необходимости писать математические операции с нуля. Такие инструменты, как Ultralytics Platform, позволяют пользователям легко обучать эти сети на пользовательских наборах данных. Следующий код на Python демонстрирует, как загрузить предварительно обученную нейронную сеть, а именно передовую модель YOLO26, и выполнить инференс на изображении с помощью пакета ultralytics.
from ultralytics import YOLO
# Load a pretrained YOLO26 neural network model
model = YOLO("yolo26n.pt")
# Run inference on an image to detect objects
# The model processes the image through its layers to predict bounding boxes
results = model("https://ultralytics.com/images/bus.jpg")
# Display the results
results[0].show()Проблемы и важные аспекты#
Несмотря на мощь, нейронные сети создают определенные сложности. Для обучения с учителем им обычно требуется большое количество размеченных данных. При недостаточном разнообразии данных сеть подвержена переобучению, при котором она запоминает обучающие примеры вместо того, чтобы учиться обобщать. Кроме того, глубокие нейронные сети часто называют «черными ящиками», поскольку бывает трудно точно понять, как они пришли к конкретному решению, что стимулирует исследования в области объяснимого AI (XAI). Такие организации, как Ассоциация стандартов IEEE, активно работают над стандартами, призванными обеспечить этичное и безопасное использование этих мощных сетей.









